京公网安备 11010802034615号
经营许可证编号:京B2-20210330
用spss判断正态性检验的几种方法
题目: 某地 120 名男性红细胞数(blood)的数据(见程序中“BEGIN DATA”与“END DATA”之间的数据),此数据呈正态分布吗?(引自马斌荣主编书著,2001. P.150)
syntax 窗口编码如下:
* Ma Bin-Rong: SPSS for Medical Application,2Edit. 2001, P.150:.
DATA LIST FREE /blood.
BEGIN DATA.
568 460 500 580 560 434 561 570 519 645 563 552
540 541 461 501 581 620 573 518 562 597 551 574
480 481 542 462 502 584 517 637 580 547 521 442
564 575 482 543 463 503 585 572 541 525 495 523
634 532 565 483 544 464 504 559 587 494 522 448
526 618 595 577 484 545 558 505 493 586 622 524
456 576 527 490 579 557 546 466 506 572 533 450
566 528 491 567 556 465 485 547 588 507 589 535
596 492 569 555 578 513 530 486 548 534 508 588
628 526 554 531 512 570 514 521 487 459 590 509
END DATA.
NPAR TESTS /K-S(NORMAL)= blood /STATISTICS=DESCRIPTIVES.
DESCRIPTIVES VARIABLES=blood /STATISTICS=ALL.
FREQUENCIES VARIABLES=blood
/STATISTICS=ALL
/HISTOGRAM=NORMAL.
PPLOT /VARIABLES=blood /TYPE=Q-Q.
注: " *````` . " 在syntax中,表示注释的意思.
FREQUENCIES 语句用来描述频次;NPAR TESTS /K-S 语句是k-s检验,检验数据是否符合特定的分布。其中ORAML 表示检验的正态分布。 另:均匀分布是 UNIFORM ;泊松分布是 POISSON ; 指数分布是 EXPONENTIAL ; PPLOT语句生成pp图,检验正态分布与否。
代码执行后,结果如下:
结果分析:
Kolmogorov-Smirnov Test 的结果中, z 值等于0.532,p值等于0.940>0.5,因此数据呈近似正态分布。
Descriptive statics结果中,偏度系数Skewness=-0..33;峰度系数Kurtosis=-0.517;两个系数都小于1,可认为近似于正态分布。
QQ Plot 中,各点近似围绕着直线,说明数据呈近似正态分布。
结果思考:
检验数据的正态性,方法有很多,k-s test,descriptive,qq plot 等方法都可以检验数据的正态性。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在机器学习建模与数据分析实战中,特征维度爆炸、冗余信息干扰、模型泛化能力差是高频痛点。面对用户画像、企业经营、医疗检测、 ...
2026-03-26在这个数据无处不在的时代,数据分析能力已不再是数据从业者的专属技能,而是成为了职场人、管理者、创业者乃至个人发展的核心竞 ...
2026-03-26在CDA(Certified Data Analyst)数据分析师的能力体系中,线性回归是连接描述性统计与预测性分析的关键桥梁,也是CDA二级认证的 ...
2026-03-26在数据分析、市场研究、用户画像构建、学术研究等场景中,我们常常会遇到多维度、多指标的数据难题:比如调研用户消费行为时,收 ...
2026-03-25在流量红利见顶、获客成本持续攀升的当下,营销正从“广撒网”的经验主义,转向“精耕细作”的数据驱动主义。数据不再是营销的辅 ...
2026-03-25在CDA(Certified Data Analyst)数据分析师的全流程工作中,无论是前期的数据探索、影响因素排查,还是中期的特征筛选、模型搭 ...
2026-03-25在当下数据驱动决策的职场环境中,A/B测试早已成为互联网产品、运营、营销乃至产品迭代优化的核心手段,小到一个按钮的颜色、文 ...
2026-03-24在统计学数据分析中,尤其是分类数据的分析场景里,卡方检验和显著性检验是两个高频出现的概念,很多初学者甚至有一定统计基础的 ...
2026-03-24在CDA(Certified Data Analyst)数据分析师的日常业务分析与统计建模工作中,多组数据差异对比是高频且核心的分析场景。比如验 ...
2026-03-24日常用Excel做数据管理、台账维护、报表整理时,添加备注列是高频操作——用来标注异常、说明业务背景、记录处理进度、补充关键 ...
2026-03-23作为业内主流的自助式数据可视化工具,Tableau凭借拖拽式操作、强大的数据联动能力、灵活的仪表板搭建,成为数据分析师、业务人 ...
2026-03-23在CDA(Certified Data Analyst)数据分析师的日常工作与认证考核中,分类变量的关联分析是高频核心场景。用户性别是否影响商品 ...
2026-03-23在数据工作的全流程中,数据清洗是最基础、最耗时,同时也是最关键的核心环节,无论后续是做常规数据分析、可视化报表,还是开展 ...
2026-03-20在大数据与数据驱动决策的当下,“数据分析”与“数据挖掘”是高频出现的两个核心概念,也是很多职场人、入门学习者容易混淆的术 ...
2026-03-20在CDA(Certified Data Analyst)数据分析师的全流程工作闭环中,统计制图是连接严谨统计分析与高效业务沟通的关键纽带,更是CDA ...
2026-03-20在MySQL数据库优化中,分区表是处理海量数据的核心手段——通过将大表按分区键(如时间、地域、ID范围)分割为多个独立的小分区 ...
2026-03-19在商业智能与数据可视化领域,同比、环比增长率是分析数据变化趋势的核心指标——同比(YoY)聚焦“长期趋势”,通过当前周期与 ...
2026-03-19在数据分析与建模领域,流传着一句行业共识:“数据决定上限,特征决定下限”。对CDA(Certified Data Analyst)数据分析师而言 ...
2026-03-19机器学习算法工程的核心价值,在于将理论算法转化为可落地、可复用、高可靠的工程化解决方案,解决实际业务中的痛点问题。不同于 ...
2026-03-18在动态系统状态估计与目标跟踪领域,高精度、高鲁棒性的状态感知是机器人导航、自动驾驶、工业控制、目标检测等场景的核心需求。 ...
2026-03-18