京公网安备 11010802034615号
经营许可证编号:京B2-20210330
EXCEL数据分析处理(3)
高级筛选可以使用较多的条件来对数据清单进行筛选,这些条件既可以是与条件,也可以是或条件,或与条件,与或条件的组合使用,还可以使用计算条件。
1.一般情况下的高级筛选
利用高级筛选对数据清单进行筛选的步骤如下:
(1)首先应建立一个条件区域。在条件区域中,同一行中的条件是与条件,也就是这些条件必须同时满足;不同行中的条件是或条件,也就是这些条件只要满足其一即可。如需要查找张三销售彩电的所有记录,则建立条件区域如图2-45所示。
图2-45 建立条件区域
(2)单击数据清单或数据库中的任一非空单元格,然后单击【数据】菜单,选择【筛选】子菜单中的【高级筛选】项,则系统弹出如图2-46所示的【高级筛选】对话框。
图2-46 【高级筛选】对话框
(3)一般情况下,系统将自动给出了数据区域,用户只需在【条件区域】栏中输入条件区域(本例中为B19:C20,也可以用鼠标拾取单元格区域,此时在条件区域中将显示“销售明细清单!$B$19:$C$20”。
(4)高级筛选结果可以显示在数据清单的原有区域中,也可以显示在工作表的其他空白单元格区域,系统默认的方式是在数据清单的原有区域中显示结果。若需要在工作表的其他空白单元格区域显示结果,则在【方式】项中选中“将筛选结果复制到其他位置”,并在【复制到】栏中输入需要显示筛选结果的单元格(开头的一个单元格即可)。图2-47为在原有区域显示的高级筛选结果。
图2-47 在原有区域显示的高级筛选结果
当需要显示原始的全部数据时,可以单击【数据】菜单,选择【筛选】子菜单中的项目,在【筛选】子菜单中选择【全部显示】即可。
同样的方法可以进行建立或条件、与条件与或条件的组合使用情况下的高级筛选。
2.计算条件情况下的高级筛选
在有些情况下,筛选的条件不是一个常数,而是一个随数据清单中数据变化的计算结果,此时无法直接利用高级筛选进行数据筛选。不过,我们可以通过计算条件的方法解决。以例2-20为例(见图2-37),这里要找出销售额大于平均销售额的所有记录。步骤如下:
(1)在数据清单以外的任一空单元格内输入平均值计算公式,比如在单元格H20中输入公式“=AVERAGE(E3:E16)”,这里要特别注意的是存放平均值计算公式的单元格的列标不能与数据清单的任一列标相同,如图2-48所示。
图2-48 计算条件情况下的高级筛选
(2)设置条件区域,条件区域的列表可以是除数据清单中数据标题以外的任何文本,而筛选条件可在单元格B20中输入“=E3>$H$20”,这里要特别注意:必须以绝对引用的方式引用销售额平均值,以相对引用的方式引用数据清单中的数据。
(3)按照前面介绍的步骤进行高级筛选,其中高级筛选的数据区域为$A$2:$G$16;高级筛选的条件区域为$B$19:$C$20,则筛选结果如图2-48所示。
在对数据进行分析时,常常需要将相同类型的数据统计出来,这就是数据的分类与汇总。在对数据进行汇总之前,应特别注意的是:首先必须对要汇总的关键字进行排序。
例如,在例2-11中,要按地区进行自动分类汇总,其步骤如下:
(1)首先对“地区”进行排序,排序方法见前面所述。
(2)单击数据清单或数据库中的任一非空单元格,然后单击【数据】菜单,选择【分类汇总】项,系统弹出如图2-49所示的【分类汇总】对话框。
图2-49 【分类汇总】对话框
(3)在【分类汇总】对话框中,【分类字段】选项下选择“地区”,【汇总方式】选项下选择“求和”,【选定汇总项】选项下选定“数量”和“金额”,单击【确定】按钮,则分类汇总的结果如图2-50所示。
图2-50 按地区分类汇总结果
在图2-50中,左上角有3个按钮,按钮1表示1级汇总,显示全部的销售数量和销售金额汇总;按钮2表示2级汇总,显示各地区的全部销售数量和销售金额汇总;按钮3表示3级汇总,显示各地区的销售数量和销售金额的汇总明细及汇总额(即图2-50所示的汇总结果)。
图2-50中,左边的滑动按钮
为隐藏明细按钮,单击此按钮,则将隐藏本级的明细数据,同时
变为显示明细按钮
,再单击
按钮,则将显示本级的全部明细数据,同时
变为
。
在上述自动分类汇总的结果上,还可以再进行分类汇总,例如再进行另一种分类汇总,两次分类汇总的关键字可以相同,也可以不同,其分类汇总方法与前面的是一样的,此处不再介绍。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
写在开头 老板在微信上甩来一句: "帮我看下为什么销量跌了。" ” 你回工位,打开 SQL,开始写。查订单表、拉近三个月、按 ...
2026-10-03CDA数据分析师 出品 作者:李诗怡 1. 事实表 vs 维度表 对比维度 事实表 维度表 核心问题 记录“业务发生了什么事” 描述 ...
2026-10-02做数据聚合时,PySpark的groupBy()确实能完成统计,这也是它的本职工作。但它有一个根本性局限:每一组数据,最终只能返回一行 ...
2026-10-01热力地图是数据可视化中极具辨识度与实用性的空间分析图表,结合地理空间维度与数据密度特征,通过颜色深浅、色阶渐变直观展示数 ...
2026-09-30 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-09-30同样是“银行数据岗”,在国有大行总行数据中心、在一家城商行的零售部、在银行系金融科技子公司、在保险公司,工作内容、成长节 ...
2026-09-29在数据分析与统计学研究中,数据往往不是独立存在的,不同变量之间普遍存在相互关联、相互影响的关系。相关性统计分析是挖掘变量 ...
2026-09-29 导读:大多数人只把 dataclasses 当成偷懒工具,用来少写 __init__、__repr__ 这类魔法方法。但它的能力远不止于此。本文带 ...
2026-09-29 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-09-29在MySQL数据库运维与业务开发中,行业普遍存在“数据达到千万级就必须分表”的说法。但在实际生产环境中,千万条数据并不是强制 ...
2026-09-28CDA数据分析师 出品 作者:李诗怡 1. 5W1H 分析法 定义:经典系统性思维框架,通过六个核心维度对问题进行全方位拆解与剖析,确 ...
2026-09-28 很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当 ...
2026-09-28CDA数据分析师 出品 作者:李诗怡 1. 用户标签体系 定义: 通过一系列高度精炼的特征标识,对用户属性、行为与偏好进行量化刻画 ...
2026-09-24Pandas是Python生态中用于表格数据处理的核心库,广泛应用于数据清洗、统计运算、报表输出、数据分析建模等场景。在处理极大数值 ...
2026-09-24随着数字经济快速发展,数据已成为核心生产要素,各行各业的业务沉淀、用户行为、设备运行、市场交易均产生海量数据。数据处理作 ...
2026-09-24 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-09-24在时序数据分析中,大部分业务数据并非持续平稳变化,而是会在某些时间节点出现突然抬升、断崖下跌、趋势反转、波动异变等现象, ...
2026-09-23在统计学与数据分析中,研究多组数据差异最常用的方法为单因素方差分析与事后多重比较。很多数据分析初学者容易混淆两者功能,认 ...
2026-09-23 很多数据分析师每天都在写 SQL,但当被问到“DQL 的本质是什么”“SELECT 子句的书写顺序与执行顺序为何不同”“INNER JOIN ...
2026-09-23 很多数据分析师写过无数个SELECT查询,但当被问到“如何新建一张表来固化中间数据”“创建视图和创建物理表有什么区别”“视 ...
2026-09-22