京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据让人看到更真实的历史
大数据研究不仅能预测人未来的行为,也能让我们更清晰地看清过往的历史。斯坦福大学Clark教授说,“历史只有工业革命前后之分,其他的历史细节虽然很有意思,但不关键。”为什么呢?一方面,世界人均GDP在公元1800年前的两三千年里基本没有变化,工业革命之后才逐渐上升;另一方面,工业革命之后人类生活方式、社会结构、政治形态以及文化内涵都有了本质性变革。
公元元年时世界人均GDP大约为445 美元 (按1990年美元算),到1820年上升到667美元,1800多年里只 增长 了50%。同期,西欧国家稍微好一些,但也只是从公元元年的450美元增长到1820年时的1204美元,英国作为工业革命的发源国也大致如此。而从1820年到2001年的180年里,世界人均GDP从原来的667美元增长到6049美元。由此可见,工业革命带来的收入增长的确是翻天覆地的。
工业革命之前的人类既然没有实现财富增长,那么他们都在忙些什么呢?那个时期,不管是东方还是西方,有很多改朝换代,但Clark教授认为,“用不着被那些表面的东西所误导”,在工业革命之前,人类社会一直没有走出“马尔萨斯模式”,即在生产率不变的情况下,自然灾害或战争导致人口死亡,使接下来的人均收入增加,为生育率上升、人口增长提供条件,可是人口增长后,人均土地和人均收入会减少,使生存挑战越来越大,又导致战争的发生并使接下来的人口又减少,在这个周期中循环。
Clark教授通过对英国人遗嘱研究发现,在工业革命之前,英国人的生育率跟财富水平高度正相关:越有钱的夫妻,小孩数量越众。在16世纪期间,最富的三分之一英国人死时平均还有4至6个小孩健在,中等财富的英国人离世时平均有3.5到4.5个小孩健在,而最穷的三分之一英国人离世时只有不到3个小孩活着。到18世纪末,基本情况仍然是越富有的家庭小孩数越多,只是每家的小孩数量都降到4个以下,并且各财富阶层间的小孩数量差距明显缩小。
工业革命到来之后,小孩数量就基本跟财富水平没有关系了。而从1880年到1980年的100年间,情况正好反过来:越穷的英国人,小孩数量反而越多,完全改变了工业革命之前“适者生存”、“有钱者生存”的规律。穷者还是追求小孩数量,而富者更注重小孩的质量和自己的生活品质。Clark教授发现工业革命之后,虽然穷人的小孩数更多,但富人的平均寿命更长,这可能是后者更侧重生活质量的结果。
Clark教授的研究结果对中国的历史研究也很有启发。公元元年时中国的人均GDP为450美元(跟西欧一样),到洋务运动的起点时也仅为530美元。在人们的基本生活水平几千年没有变化的情况下,那些制度与文化体系是经历了几千年的检验,还是只经历了几年、一两个朝代的考验,并不存在本质性差别。从这个意义上讲,在收入与生活方式处于静态不变的状况下,那些朝代到底叫“汉朝”、“隋朝”、“唐朝”、“宋朝”,还是“元朝”、“明朝”或“清朝”,这些细节意义不是那么大,至少没有原来我们强调的那么大。
鸦片战争敲开了国门,洋务运动把工业革命请进中国,由此真正把引发社会变革的工业技术和相配思维方式带入中国,让中国有机会走出困扰社会几千年的马尔萨斯式陷阱,结束过去重复的静态朝代更替周期。
玉米和红薯曾这样影响中国
瑞典斯德哥尔摩大学贾瑞雪教授研究中国历年农民暴动起义跟自然灾害的关系。她的量化历史研究发现:在16世纪玉米、红薯进中国前,干旱年里平均每12个州府地区就有一个发生农民起义或暴动,而玉米、红薯于16世纪引进中国后,即使在干旱年,每40个州府才有一个发生农民起义。主要原因在于这些“新世界”粮食作物对水稻有很强的补充作用。从这个意义上说,虽然红薯、玉米不像大米那么受欢迎,但是在干旱年份,如果是在暴动起义和红薯、玉米之间做选择,农民更愿意选择后者。
哥伦布发现美洲后,西班牙人先是从现在的墨西哥把玉米、红薯和土豆带回欧洲。按照学者估算,仅土豆一项就使欧洲人口在1700-1900年两百年间增长25%,使欧洲城市化率从27%到35%,并帮助催化了工业革命的发生。
这些作物随后传入中国。香港科技大学龚启圣教授和他的合作者要研究的问题主要有三个:第一,到底是因为引进了这三项农作物使中国人口从1500年的1.3亿上升到1900年的4亿,还是因为中国人口已经增长太多,到16、17世纪不得不寻找新的粮食作物?第二,如果是这些新作物激发了中国人口增长,其具体贡献有多大?第三,这些新作物是否也催化了中国的人均收入增长?
他们找到了23个省1330个县的县志,从1550年左右开始研究各县志哪年首次提到玉米,依此勾画出玉米在中国的扩散途径和持续时间。他们发现,玉米最早是经三条路径进入中国:第一条路径是丝绸之路,玉米经中亚于1560年左右进入甘肃,第二条是经印度于1563年进入云南,第三条途径是经菲律宾于1572年进入福建。
接下来,龚教授把引进了玉米的县和还没引进玉米的邻县,形成两个样本,比较这两组县每隔十年的人口密度差别。在考虑到自然灾害、战争死亡等因素之后,他们的数据分析发现:按照1776年、1820年、1851年、1890年、1910年几个时间点看,在每个时期,已经引进玉米的县人口密度明显高于没有引进玉米的县,而且一个县已经种植玉米的年份越长,其人口密度高出的就越多。种玉米的时间每多十年,其人口密度就多增5%-6%。
经过各种严格计量方法的验证,他们得出的结论为:是玉米带动了中国的人口增长,而不是人口增长压力迫使中国引进玉米、红薯。而且从1776年到1910年间,中国14.12%的人口增长是由玉米所致。而从16世纪初到20世纪初,中国粮食增量的55%是由于这三项新作物。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
数据分析的核心价值在于用数据驱动决策,而指标作为数据的“载体”,其选取的合理性直接决定分析结果的有效性。选对指标能精准定 ...
2026-01-23在MySQL查询编写中,我们习惯按“SELECT → FROM → WHERE → ORDER BY”的语法顺序组织语句,直觉上认为代码顺序即执行顺序。但 ...
2026-01-23数字化转型已从企业“可选项”升级为“必答题”,其核心本质是通过数据驱动业务重构、流程优化与模式创新,实现从传统运营向智能 ...
2026-01-23CDA持证人已遍布在世界范围各行各业,包括世界500强企业、顶尖科技独角兽、大型金融机构、国企事业单位、国家行政机关等等,“CDA数据分析师”人才队伍遵守着CDA职业道德准则,发挥着专业技能,已成为支撑科技发展的核心力量。 ...
2026-01-22在数字化时代,企业积累的海量数据如同散落的珍珠,而数据模型就是串联这些珍珠的线——它并非简单的数据集合,而是对现实业务场 ...
2026-01-22在数字化运营场景中,用户每一次点击、浏览、交互都构成了行为轨迹,这些轨迹交织成海量的用户行为路径。但并非所有路径都具备业 ...
2026-01-22在数字化时代,企业数据资产的价值持续攀升,数据安全已从“合规底线”升级为“生存红线”。企业数据安全管理方法论以“战略引领 ...
2026-01-22在SQL数据分析与业务查询中,日期数据是高频处理对象——订单创建时间、用户注册日期、数据统计周期等场景,都需对日期进行格式 ...
2026-01-21在实际业务数据分析中,单一数据表往往无法满足需求——用户信息存储在用户表、消费记录在订单表、商品详情在商品表,想要挖掘“ ...
2026-01-21在数字化转型浪潮中,企业数据已从“辅助资源”升级为“核心资产”,而高效的数据管理则是释放数据价值的前提。企业数据管理方法 ...
2026-01-21在数字化商业环境中,数据已成为企业优化运营、抢占市场、规避风险的核心资产。但商业数据分析绝非“堆砌数据、生成报表”的简单 ...
2026-01-20定量报告的核心价值是传递数据洞察,但密密麻麻的表格、复杂的计算公式、晦涩的数值罗列,往往让读者望而却步,导致核心信息被淹 ...
2026-01-20在CDA(Certified Data Analyst)数据分析师的工作场景中,“精准分类与回归预测”是高频核心需求——比如预测用户是否流失、判 ...
2026-01-20在建筑工程造价工作中,清单汇总分类是核心环节之一,尤其是针对楼梯、楼梯间这类包含多个分项工程(如混凝土浇筑、钢筋制作、扶 ...
2026-01-19数据清洗是数据分析的“前置必修课”,其核心目标是剔除无效信息、修正错误数据,让原始数据具备准确性、一致性与可用性。在实际 ...
2026-01-19在CDA(Certified Data Analyst)数据分析师的日常工作中,常面临“无标签高维数据难以归类、群体规律模糊”的痛点——比如海量 ...
2026-01-19在数据仓库与数据分析体系中,维度表与事实表是构建结构化数据模型的核心组件,二者如同“骨架”与“血肉”,协同支撑起各类业务 ...
2026-01-16在游戏行业“存量竞争”的当下,玩家留存率直接决定游戏的生命周期与商业价值。一款游戏即便拥有出色的画面与玩法,若无法精准识 ...
2026-01-16为配合CDA考试中心的 2025 版 CDA Level III 认证新大纲落地,CDA 网校正式推出新大纲更新后的第一套官方模拟题。该模拟题严格遵 ...
2026-01-16在数据驱动决策的时代,数据分析已成为企业运营、产品优化、业务增长的核心工具。但实际工作中,很多数据分析项目看似流程完整, ...
2026-01-15