京公网安备 11010802034615号
经营许可证编号:京B2-20210330
SPSS分析技术:偏相关分析
相关分析是研究两个变量共同变化的密切程度,但有时出现相关的两个变量又同时与另外的一个变量相关,在这三个变量中,有可能只是由于某个变量充当了相关性的中介作用,而另外的两个变量并不存在实质性的相关关系。这种情形导致数据分析中出现“伪相关”现象,造成伪相关现象的变量被称为“桥梁变量”。
例如,在研究大学生上网时间,游戏时间、完成作业情况、考试成绩的相关性时,往往发现上网时间与作业情况、考试成绩呈现不明显的负相关性,同时上网时间又和游戏时间呈现高度正相关性,游戏时间与作业情况、考试成绩也呈现为负相关性。那么,上网时间与作业情况、考试成绩之间的微弱负相关性是真的吗?
在数据的相关性分析中,为了摒弃桥梁变量的影响力,发现变量内部隐藏的真正相关性,人们引入了偏相关分析的概念。偏相关分析是在剔除控制变量的影响下,分析指定变量之间是否存在显著的相关性。
偏相关分析
首先在验证了数据内部存在相关性后,如果怀疑可能存在桥梁变量,则可以把桥梁变量作为控制变量,重新进行相关性分析,检查在排除了桥梁变量的影响力之后,其它变量之间是否还存在关联性。如果开始有相关关系,剔除了控制变量之后,相关关系不存在了,说明控制变量为桥梁变量。
范例分析
现在采集到60条学生数据,分析上网时间、游戏时间、作业情况和数学成绩之间的相关性,并探索本案例中是否存在桥梁变量。数据如下:
SPSS分析步骤
1、选择菜单【分析】-【相关】-【双变量】命令,启动四个变量的相关性分析,操作如下图,将上网时间、游戏时间、作业情况和数学成绩选入变量区域内,进行分析。
2、分析者根据实际情况,怀疑游戏时间是桥梁变量,因为游戏时间的存在,导致另外三个变量之间存在着高度相关性。因此以游戏时间作为控制变量,进行偏相关分析。选择菜单【分析】-【相关】-【偏相关】命令,启动偏相关分析,将上网时间、作业情况和数学成绩选为变量,将游戏时间选为控制变量。
结果分析
双变量相关分析结果如下:
从上图结果可知,上网时间与游戏时间是正相关的(相关系数为1,概率为0.000);与作业情况和数学成绩是负相关的(相关系数为-0.957和-0.986,检验概率都为0),表示这四个变量之间都存在着显著相关性。
偏相关分析结果

从上图结果可知,当剔除游戏时间以后,上网时间与作业情况和数学成绩之间的相关系数都为0,显著性为1,大于0.05,说明它们之间不存在相关性。
结论
在本案例中,直接分析四个变量的相关性水平发现,上网时间与作业情况、数学成绩之间存在显著相关。然而,偏相关检验的结论说明,上网时间与作业情况,数学成绩的显著相关是由游戏时间引起的,游戏时间在上网时间、作业情况和数学成绩之间起到桥梁作用,它确实是一个桥梁变量。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在分类变量关联分析中(如 “吸烟与肺癌的关系”“性别与疾病发病率的关联”),卡方检验 P 值与 OR 值(比值比,Odds Ratio)是 ...
2025-11-05CDA 数据分析师的核心价值,不在于复杂的模型公式,而在于将数据转化为可落地的商业行动。脱离业务场景的分析只是 “纸上谈兵” ...
2025-11-05教材入口:https://edu.cda.cn/goods/show/3151 “纲举目张,执本末从。” 若想在数据分析领域有所收获,一套合适的学习教材至 ...
2025-11-05教材入口:https://edu.cda.cn/goods/show/3151 “纲举目张,执本末从。” 若想在数据分析领域有所收获,一套合适的学习教材至 ...
2025-11-04【2025最新版】CDA考试教材:CDA教材一级:商业数据分析(2025)__商业数据分析_cda教材_考试教材 (cdaglobal.com) ...
2025-11-04在数字化时代,数据挖掘不再是实验室里的技术探索,而是驱动商业决策的核心能力 —— 它能从海量数据中挖掘出 “降低成本、提升 ...
2025-11-04在 DDPM(Denoising Diffusion Probabilistic Models)训练过程中,开发者最常困惑的问题莫过于:“我的模型 loss 降到多少才算 ...
2025-11-04在 CDA(Certified Data Analyst)数据分析师的工作中,“无监督样本分组” 是高频需求 —— 例如 “将用户按行为特征分为高价值 ...
2025-11-04当沃尔玛数据分析师首次发现 “啤酒与尿布” 的高频共现规律时,他们揭开了数据挖掘最迷人的面纱 —— 那些隐藏在消费行为背后 ...
2025-11-03这个问题精准切中了配对样本统计检验的核心差异点,理解二者区别是避免统计方法误用的关键。核心结论是:stats.ttest_rel(配对 ...
2025-11-03在 CDA(Certified Data Analyst)数据分析师的工作中,“高维数据的潜在规律挖掘” 是进阶需求 —— 例如用户行为包含 “浏览次 ...
2025-11-03在 MySQL 数据查询中,“按顺序计数” 是高频需求 —— 例如 “统计近 7 天每日订单量”“按用户 ID 顺序展示消费记录”“按产品 ...
2025-10-31在数据分析中,“累计百分比” 是衡量 “部分与整体关系” 的核心指标 —— 它通过 “逐步累加的占比”,直观呈现数据的分布特征 ...
2025-10-31在 CDA(Certified Data Analyst)数据分析师的工作中,“二分类预测” 是高频需求 —— 例如 “预测用户是否会流失”“判断客户 ...
2025-10-31在 MySQL 实际应用中,“频繁写入同一表” 是常见场景 —— 如实时日志存储(用户操作日志、系统运行日志)、高频交易记录(支付 ...
2025-10-30为帮助教育工作者、研究者科学分析 “班级规模” 与 “平均成绩” 的关联关系,我将从相关系数的核心定义与类型切入,详解 “数 ...
2025-10-30对 CDA(Certified Data Analyst)数据分析师而言,“相关系数” 不是简单的数字计算,而是 “从业务问题出发,量化变量间关联强 ...
2025-10-30在构建前向神经网络(Feedforward Neural Network,简称 FNN)时,“隐藏层数目设多少?每个隐藏层该放多少个神经元?” 是每个 ...
2025-10-29这个问题切中了 Excel 用户的常见困惑 —— 将 “数据可视化工具” 与 “数据挖掘算法” 的功能边界混淆。核心结论是:Excel 透 ...
2025-10-29在 CDA(Certified Data Analyst)数据分析师的工作中,“多组数据差异验证” 是高频需求 —— 例如 “3 家门店的销售额是否有显 ...
2025-10-29