《Python数据分析极简入门》

第2节 8-2 Pandas 数据重塑 - 数据堆叠

数据堆叠

df = pd.DataFrame({'专业': np.repeat(['数学与应用数学', '计算机', '统计学','物理学'], 6),
                   '班级': ['1班','2班','3班']*8,
                   '科目': ['高数', '线代'] * 12,
                   '平均分': [random.randint(60,100) for i in range(24)],
                   '及格人数': [random.randint(30,50) for i in range(24)]})

df2 = pd.pivot_table(df, index=['专业','科目'],  values=['及格人数','平均分'],
               aggfunc={'及格人数':np.sum,"平均分":np.mean})
df2

		及格人数	平均分
专业	科目
数学与应用数学	线代	107	76.000000
数学与应用数学	高数	107	65.000000
物理学	线代	111	82.333333
物理学	高数	115	78.666667
统计学	线代	107	71.000000
统计学	高数	122	74.000000
计算机	线代	122	78.333333
计算机	高数	137	74.000000

stacked = df2.stack()

“压缩”后的DataFrame或Series(具有MultiIndex作为索引)， stack() 的逆操作是unstack()，默认情况下取消最后压缩的那个级别：

堆叠stack()，顾名思义就是把透视结果堆到一起。接下来我们把透视后堆叠的数据一步步展开unstack()：

stacked.unstack()

		及格人数	平均分
专业	科目
数学与应用数学	线代	107.0	76.000000
数学与应用数学	高数	107.0	65.000000
物理学	线代	111.0	82.333333
物理学	高数	115.0	78.666667
统计学	线代	107.0	71.000000
统计学	高数	122.0	74.000000
计算机	线代	122.0	78.333333
计算机	高数	137.0	74.000000

stacked.unstack(level=1)

	科目	线代	高数
专业
数学与应用数学	及格人数	107.000000	107.000000
数学与应用数学	平均分	76.000000	65.000000
物理学	及格人数	111.000000	115.000000
物理学	平均分	82.333333	78.666667
统计学	及格人数	107.000000	122.000000
统计学	平均分	71.000000	74.000000
计算机	及格人数	122.000000	137.000000
计算机	平均分	78.333333	74.000000

stacked.unstack(level=0)

	专业	数学与应用数学	物理学	统计学	计算机
科目
线代	及格人数	107.0	111.000000	107.0	122.000000
线代	平均分	76.0	82.333333	71.0	78.333333
高数	及格人数	107.0	115.000000	122.0	137.000000
高数	平均分	65.0	78.666667	74.0	74.000000

CDA数据分析师考试相关入口一览（建议收藏）：

▷ 想报名CDA认证考试，点击>>> “CDA报名” 了解CDA考试详情；

▷ 想学习CDA考试教材，点击>>> “CDA教材” 了解CDA考试详情；

▷ 想加入CDA考试题库，点击>>> “CDA题库” 了解CDA考试详情；

▷ 想了解CDA考试含金量，点击>>> “CDA含金量” 了解CDA考试详情；

pandas DataFrame 压缩 Series 索引数据分析

数据分析咨询请扫描二维码

若不方便扫码，搜微信号：CDAshujufenxi

上一篇数据分析师教程《Python数据分析极简入门》第2节 8-1 Pandas 数据重塑 - 数据变形

下一篇数据分析师教程《Python数据分析极简入门》第2节 8-2 Pandas 数据重塑 - 数据堆叠

数据分析师教程《Python数据分析极简入门》第2节 8-1 Pandas 数据重塑 - 数据堆叠

《Python数据分析极简入门》

第2节 8-2 Pandas 数据重塑 - 数据堆叠

数据堆叠

CDA考试动态

CDA报考指南

热门栏目

最新资讯

【CDA干货】互联网运营必看：私域用户质量数据分析 ...

【CDA持证人案例分享】用 Excel 精准监控电商及推广 ...

【CDA持证人干货分享】13年国企财务：如何借助DeepS ...

【CDA持证人案例分享】Excel动态报表设计：基于业务 ...

【CDA干货】字节大佬：如何通过动态分级快速提升转 ...

Windows 系统和 MacOS 系统下的 Anaconda 安装教程 ...

数据运营的工作内容、技能要求及发展前景 ...

【干货】字节大佬：教培行业销售运营全景作战地图【 ...

四大一线城市约50%人口租房，数据分析能挖出哪些 “ ...

Python 实战案例 —RFM 客户价值分析模型 ...

【案例】奥利奥坚果新品与蒙牛“数字牧场”的成功经 ...

美关税政策下的全球金融市场动荡：深度数据分析与洞 ...

【重磅】苹果捐赠3000万给浙大这专业，透露未来就业 ...

非专业，怎么才能证明自己的数据分析能力？ ...

保姆级教程！一文读懂数据分析师的职业发展路径 ...

【干货】用DeepSeek三步骤搞定Excel数据清洗，效率 ...

被统计公式劝退？这门极简课程让你14天学会用Python ...

【干货】如何用RFM模型精准识别高价值客户？ ...

CDA数据分析师就业班3月29日开班，仅剩1个名额 ...

【案例】网飞Netflix流量漏斗分析案例 ...