解密数据的真相,什么是平均数,中位数,标准差_数据分析师
2013年1月24日羊城晚报消息显示,广州国家统计局广东调查总队公布了2012年广东城镇居民人均可支配收入的平均数是30,226.71元,再平均到12个月,月收入就是2519元。
这里需要注意的是,通常我们说的平均数,都是指算术平均数,就是数值相加的总和除以样本个数。计算平均收入,就是把每个人的收入相加,除以总人数,这样的平均,其实掩盖了不少真相。
社会财富的分布,一般符合二八原则,20%的人拥有80%的财富,80%的大众只拥有20%的财富,从平均数我们难以知道收入的真实分布。譬如一个月收入5000元的人,处于什么样的一个水平呢?大多数人的收入状况如何呢?
因此有人呼吁政府公布收入的中位数,也就是在所有数字中,位于中间的那个数字。例如数字序列2000、4000、5000、6000、28000,中位数就是5000,平均数是9000。
如果这是一个小公司,上面的5个数字,是工资,某人去面试,了解到这家公司的平均工资是9000,感觉员工收入还不错,但实际上大家的平均工资被28000元的一个人拉高了,也就是我们说的被平均了。
2013年国家统计局广东调查总队首次公布了中位数,2012年广东城镇居民人均可支配收入中位数为27213.99元,这时我们就可以知道50%的人年收入在2.7万元以上,也就是月收入2268元。如果需要更加真实的了解海量数据的分布,就需要计算四分位数,甚至是十分位数,不知道以后是否会公布,让我们知道贫富差距究竟有多大。
下表中的两个产品的按月用户活跃数据,也就是我们经常说的MAU,不知道大家如何评价这两个产品的活跃表现?
从平均数看,产品1平均月活跃用户为32167,产品2平均月活跃用户为24250,如果没有看到原始数据,得出的结论是产品1的平均月活高于产品2。
12个月的数据,不算多,明眼人都可以看出来,产品1的月活跃主要集中在1-3月,但4月到11月,月活跃下滑严重;产品2的月活跃发展比较稳定,且成上升趋势。我们用EXCEL画出柱状图,更加直观。
这个时候,如果是用数据描述,应该采用哪个指标呢?这就是离散程度的描述,通常用标准差进行描述。以后BLUES单独和大家聊下标准差,这个很有价值的统计量。
使用EXCEL2010版的“数据分析——描述统计”功能,很快就计算出下表的各个统计指标:
产品的标准差是40177,产品2的标准差是11871,远远小于产品1,说明产品2的月活跃离散程度远远小于产品1,也就是,大家通常说的,数据分布比较平均,个体差异小。
再看中位数,产品1是12500,也就是说1年中有6个月的活跃数在12500之下,产品2的中位数是20000。
如何评价两个产品的月活跃分布,大家自己拿主意吧。
今天的分享,就记住三个统计指标:平均数、中位数、标准差。
数据分析咨询请扫描二维码
《Python数据分析极简入门》 第2节 5 Pandas数学计算 importpandasaspdd=np.array([[81,&n ...
2024-11-23数据分析涉及多个方面的学习,包括理论知识和实践技能。以下是数据分析需要学习的主要方面: 基础知识: 数据分析的基本概念 ...
2024-11-22数据分析适合在多个单位工作,包括但不限于以下领域: 金融行业:金融行业对数据分析人才的需求非常大,数据分析师可以从事经 ...
2024-11-22数据分析是一种涉及从大量数据中提取有用信息和洞察力的过程。其工作内容主要包括以下几个方面: 数据收集与整理:数据分析师 ...
2024-11-22数据分析师需要掌握多种技能,以确保能够有效地处理和分析数据,并为业务决策提供支持。以下是数据分析师需要掌握的主要技能: ...
2024-11-22数据开发和数据分析是两个密切相关但又有所区别的领域。以下是它们的主要区别: 定义和目标: 数据开发:数据开发涉及数据的 ...
2024-11-22数据架构师是负责设计和管理企业数据架构的关键角色,其职责涵盖了多个方面,包括数据治理、数据模型设计、数据仓库构建、数据安 ...
2024-11-22数据分析师需要具备一系列技能,以确保能够有效地处理、分析和解释数据,从而支持决策制定。以下是数据分析师所需的关键技能: ...
2024-11-22数据分析师需要具备一系列技能,以确保能够有效地处理、分析和解释数据,从而支持决策制定。以下是数据分析师所需的关键技能: ...
2024-11-22数据分析师需要具备一系列的技能和能力,以确保能够有效地处理、分析和解释数据,从而支持业务决策。以下是数据分析师所需的主要 ...
2024-11-22需求持续增长 - 未来数据分析师需求将持续上升,企业对数据驱动决策的依赖加深。 - 预测到2025年,中国将需要高达220万的数据人 ...
2024-11-22《Python数据分析极简入门》 第2节 4 Pandas条件查询 在pandas中,可以使用条件筛选来选择满足特定条件的数据 importpanda ...
2024-11-22数据分析师的工作内容涉及多个方面,主要包括数据的收集、整理、分析和可视化,以支持商业决策和问题解决。以下是数据分析师的一 ...
2024-11-21数据分析师必须掌握的技能可以从多个方面进行归纳和总结。以下是数据分析师需要具备的主要技能: 统计学基础:数据分析师需要 ...
2024-11-21数据分析入门的难易程度因人而异,总体来看,入门并不算特别困难,但需要一定的学习和实践积累。 入门难度:数据分析入门相对 ...
2024-11-21数据分析是一项通过收集、整理和解释数据来发现有用信息的过程,它在现代社会中具有广泛的应用和重要性。数据分析能够帮助人们更 ...
2024-11-21数据分析行业正在迅速发展,随着技术的不断进步和数据量的爆炸式增长,企业对数据分析人才的需求也与日俱增。本文将探讨数据分析 ...
2024-11-21数据分析的常用方法包括多种技术,每种方法都有其特定的应用场景和优势。以下是几种常见的数据分析方法: 对比分析法:通过比 ...
2024-11-21企业数字化转型是指企业利用数字技术对其业务进行改造和升级,以实现提高效率、降低成本、创新业务模式等目标的过程。这一过程不 ...
2024-11-21数据分析作为一个备受追捧的职业领域,吸引着越来越多的女性加入其中。对于女生而言,在选择成为一名数据分析师时,行业选择至关 ...
2024-11-21