历史数据集是在某个日期从某个总体收集的一组数字。用好它,意味着在下结论之前先说明:衡量什么、什么时候、针对谁。当深度研究的史料里出现人口普查数字、调查结果、法庭记录或产量总计时,就会用到这项技能。
它承接界定题目范围,属于美国深度研究学习路径。
对任何数据集该问什么?
按顺序问五个问题。
- **衡量什么?**拥有某物的住户、逮捕、工资、选票。
- **什么时候?**统计的年份或时期。
- **统计了谁或什么?**总体及其规模。
- **影响有多大?**用百分比或差值,并保留原始数字。
- **它不能说明什么?**原因、其他地方、其他年份、未被统计的群体。
例题
以下数字是为练习虚构的。这个城镇和调查并不存在。
**数据集 A(虚构)。**1926 年对一个虚构城镇 250 户住户的调查:50 户拥有收音机。
**数据集 B(虚构)。**1930 年对同一虚构城镇 400 户住户的调查:140 户拥有收音机。
**题目:**关于这个城镇的收音机拥有情况,你能得出什么?
**第 1 步,衡量什么:**拥有收音机的住户。
**第 2 步,日期:**1926 年和 1930 年。
**第 3 步,总体:**一个虚构城镇的住户。两次调查规模不同:250 和 400。
**第 4 步,变化幅度:**由于群体大小不同,用百分比。
- 1926 年:50 ÷ 250 = 0.20,即 20%。
- 1930 年:140 ÷ 400 = 0.35,即 35%。
受调查住户中拥有收音机的比例上升了 15 个百分点。原始数量增加了 90 户,但单看这个比较会误导,因为调查规模不同。
**第 5 步,局限:**数据没有显示拥有率上升的原因、两次调查的是不是同一批住户,也没有显示其他城镇的情况。
**答案:**在这个虚构城镇,受调查住户中拥有收音机的比例从 1926 年的 20% 上升到 1930 年的 35%。数据不能说明原因,也不能说明全国的模式。
要留意的错误
一位学生就这个数据集写了这句话。
“到 1930 年,35% 的美国人拥有收音机。”
这句话改变了总体和被统计的对象。数据涵盖的是一个虚构城镇的住户,不是美国人;统计的是按住户计的拥有,不是按个人。它还把这个城镇当成了所有人的代表。
更正:“在一个虚构城镇,1930 年有 35% 的受调查住户拥有收音机。”
自我检测
1. 1928 年一项虚构调查针对 300 户住户,发现 90 户拥有收音机。百分比是多少?
显示答案
90 ÷ 300 = 0.30,所以是 30%。验算:300 的 30% 是 90。
2. 在另一个虚构城镇,1928 年 240 户中有 60 户拥有收音机。你能说这个城镇的收音机拥有率比第 1 题的城镇高吗?
显示答案
60 ÷ 240 = 0.25,即 25%,低于 30%。在这两项虚构调查中,第一个城镇的比例更高。但你仍然不能说明原因,也不能对其他城镇下结论。
3. 指出这句话中的总体和日期:“某城市 1925 年的 1,200 宗法庭案件说明犯罪已经失控。”
显示答案
总体:一个城市的法庭案件,没有给出对比年份。日期:1925 年。“失控”是意见,不是这个数字能证明的。要谈变化,需要第二个日期或对比群体。
接下来学什么
数字总是与观点并存,所以下一课是有出处地比较同时代观点。综合练习把数据和观点混在一起。
如果表格和百分比让史料题显得比实际更难,我们的老师可以在线上一对一历史辅导中陪你逐步处理。