京公网安备 11010802034615号
经营许可证编号:京B2-20210330
SPSS正态分布以及方差齐性检验以及Wilcox检验
方差分析、t-test等基本上都是我们常用的工具,但是还是有不少小伙伴,特别是刚入坑的小伙伴分不清楚,今天是说几句,老司机也可以收藏给以后的师弟师妹。第二篇关于三种t检验的适用情况说明(单一样本t检验,配对样本t检验,独立样本t检验),是我几天前看到采集而来,一并放到这里做个简单的汇总。
t检验要求数据正态分布以及方差齐性。一般来说一些常见的表型数据符合正态分布以及方差齐性的要求。但对于其他类型的数据,就不一定满足这两点了。所以在进行t检验之前,首先要进行数据的正态检验以及方差齐性检验。在SPSS中的具体操作如下:
输入的数据格式如下:
1、在菜单栏选择“分析”-“描述统计”-“探索”,如下图。
2、将分组信息group添加到“因子列表”,其他数据添加到“因变量列表”,如下图。
3、设置“统计”选项卡,所有勾选的都选上即可,如下图。
4、设置“图(T)”选项卡,设置如下图,按下图设置之后点击“继续”。
5、完成上述设置之后,点击“确定即可”,稍微等待即可出现结果。
6、这一步会出来很多统计结果,下面只介绍我们关心的正态分布检验和方差齐性检验,正态分布检验结果如下表。
从上表我们看出,显著性(p值)远小于0.001,即显著,则能够拒绝他们服从正态分布的假设。即该组数据不符合正态分析,也就不能使用t检验和方差分析(ANOVA),不管此时方差是否齐性均不能使用上述两种检验。
其实数据是否符合正态分布我们在正方图或Q-Q图上基本上也能看出,如下图,均不是正态分布。数据正态分布时,数据点基本沿直线两侧分布。
7、如果数据符合符合正态分布下面就要进行方差齐性检验,结果如下图。
从上表我们可以看到其显著性(P<0.001)非常小,这说明我们要拒绝他们总体方差相等的假设,即此时方差不齐,不能使用t检验以及方差分析。
那么此时应该使用什么统计方法呢,一般时使用Mann-Whitney U 秩和检验(Wilcox检验),或者Kruskal-Wallis检验。两组数据比较使用Wilcox检验,而多组数据比较使用Kruskal-Wallis检验。切记需要满足的条件是:在进行多个群组之间比较时,因为群组不满足正态分布而不能使用ANOVA多比较,那么你可以使用Kruskal-Wallis检验,当只有两组时,使用基于两样本的Wilcox检验。
那么在SPSS里该如何进行Kruskal-Wallis检验和Wilcox检验分析呢?此部分暂时只说Wilcox检验分析,其实Kruskal-Wallis检验在SPSS里操作也是类似的,只不过Kruskal-Wallis检验适用于多重比较。分析入口如下。
点击"确定"之后,接下来会弹出一个设置页面,如下图,该页面包含3个子页面即“目标”,“字段”,“设置”。其中目标这个可以保持默认设置,字段以及设置的页面如下。
按照上述页面设置之后,点击运行即可。最后结果如下图所示。
这是输出的主要结果,零假设是“基因表达水平的分布在两组之间相同”,除root_z13之外,P<0.05,故拒绝原假设,认为基因的表达水平在两组之间有统计学差异。而root_z13则没有显著的统计学差异。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在金融行业的数字化转型进程中,SQL作为数据处理与分析的核心工具,贯穿于零售银行、证券交易、保险理赔、支付结算等全业务链条 ...
2025-12-24在数据分析领域,假设检验是验证“数据差异是否显著”的核心工具,而独立样本t检验与卡方检验则是其中最常用的两种方法。很多初 ...
2025-12-24在企业数字化转型的深水区,数据已成为核心生产要素,而“让数据可用、好用”则是挖掘数据价值的前提。对CDA(Certified Data An ...
2025-12-24数据分析师认证考试全面升级后,除了考试场次和报名时间,小伙伴们最关心的就是报名费了,报 ...
2025-12-23CDA中国官网是全国统一的数据分析师认证报名网站,由认证考试委员会与持证人会员、企业会员以及行业知名第三方机构共同合作,致 ...
2025-12-23在Power BI数据可视化分析中,矩阵是多维度数据汇总的核心工具,而“动态计算平均值”则是矩阵分析的高频需求——无论是按类别计 ...
2025-12-23在SQL数据分析场景中,“日期转期间”是高频核心需求——无论是按日、周、月、季度还是年度统计数据,都需要将原始的日期/时间字 ...
2025-12-23在数据驱动决策的浪潮中,CDA(Certified Data Analyst)数据分析师的核心价值,早已超越“整理数据、输出报表”的基础层面,转 ...
2025-12-23在使用Excel数据透视表进行数据分析时,我们常需要在透视表旁添加备注列,用于标注数据背景、异常说明、业务解读等关键信息。但 ...
2025-12-22在MySQL数据库的性能优化体系中,索引是提升查询效率的“核心武器”——一个合理的索引能将百万级数据的查询耗时从秒级压缩至毫 ...
2025-12-22在数据量爆炸式增长的数字化时代,企业数据呈现“来源杂、格式多、价值不均”的特点,不少CDA(Certified Data Analyst)数据分 ...
2025-12-22在企业数据化运营体系中,同比、环比分析是洞察业务趋势、评估运营效果的核心手段。同比(与上年同期对比)可消除季节性波动影响 ...
2025-12-19在数字化时代,用户已成为企业竞争的核心资产,而“理解用户”则是激活这一资产的关键。用户行为分析系统(User Behavior Analys ...
2025-12-19在数字化转型的深水区,企业对数据价值的挖掘不再局限于零散的分析项目,而是转向“体系化运营”——数据治理体系作为保障数据全 ...
2025-12-19在数据科学的工具箱中,析因分析(Factor Analysis, FA)、聚类分析(Clustering Analysis)与主成分分析(Principal Component ...
2025-12-18自2017年《Attention Is All You Need》一文问世以来,Transformer模型凭借自注意力机制的强大建模能力,在NLP、CV、语音等领域 ...
2025-12-18在CDA(Certified Data Analyst)数据分析师的时间序列分析工作中,常面临这样的困惑:某电商平台月度销售额增长20%,但增长是来 ...
2025-12-18在机器学习实践中,“超小数据集”(通常指样本量从几十到几百,远小于模型参数规模)是绕不开的场景——医疗领域的罕见病数据、 ...
2025-12-17数据仓库作为企业决策分析的“数据中枢”,其价值完全依赖于数据质量——若输入的是缺失、重复、不一致的“脏数据”,后续的建模 ...
2025-12-17在CDA(Certified Data Analyst)数据分析师的日常工作中,“随时间变化的数据”无处不在——零售企业的每日销售额、互联网平台 ...
2025-12-17