京公网安备 11010802034615号
经营许可证编号:京B2-20210330
SPSS用于正交试验优化设计及其方差分析_数据分析师考试
试验优化设计,指在最优化思想的指导下,进行最优设计的一种优化方法,从不同的优良性出发,合理设计试验方案,有效控制试验干扰,科学处理试验数据,全面进行优化分析,直接实现优化目标。
正交试验设计是试验优化的常用技术,在农业试验、工业优化、商业优化等方面应用已久。主要优点是能在多试验条件中选出代表性强的少数试验方案,通过对这些少数试验方案结果的分析,从中找出最优方案或最佳生产工艺条件,并可以得到比试验结果本身给出的还要多的有关各因素的信息。
SPSS软件不仅具有包括数据管理、统计分析、图表分析、输出管理等在内的基本统计功能, 而且用它处理正交试验设计中的数据程序简单, 分析结果明了。
明确通过正交试验想要解决什么问题,确定用来衡量试验效果的评价指标,并详细描述出评定该指标的原则标准、测定指标的方法重要信息。
有依据的选择引起指标变化的影响因素,因素在试验中的各种状态称为因素的水平。尽量选择适用于人为控制的和调节的影响因素,最后列出因素水平表。
在能够安排下试验因素和交互作用前提下,尽可能选用较小的正交表,以减少试验次数和成本的消耗。
表头设计即将试验因素安排到所选正交表的各列中去的过程。正交表中的任意一列的位置是一样的,可以任意变换,因此不考虑交互作用的情况下可直接将所有因素安排在任意一列;如果考虑交互作用,则必须按照交互作用列表的规定进行配列;为避免混杂,那些主要因素重点考察的因素涉及交互作用较多的因素,应优先安排;特别注意,尽可能安排空列,用于反映试验误差,并以此作为衡量试验因素产生的效应是否可靠的标志。
表头设计完成后,将所选正交表中各列的不同数字换成对应因素的相应水平,形成试验方案。试验方案中的试验号并不意味着实际进行试验的顺序,一般需同时进行,若条件不允许,为排除外界环境干扰,应使试验序号随机化。
按照随机化的试验顺序进行试验,记录结果必备分析。
7、试验结果的统计分析
正交设计的结果分析有两种,一种是极差分析法(直观分析法),只考虑因素间的影响,不考虑试验误差。另一种是方差分析法,是一种精细化分析方法,可采用spss完成。
我们用正交试验的方法,对从中草药虎杖中提取白藜芦醇苷的工艺进行优化。
(1)明确目的,确定指标:这是工艺优化的案例,目的在于通过试验,寻求优选白藜芦醇苷的最佳提取条件,白藜芦醇苷提取的效果指标为白藜芦醇苷含量。
(2)挑因素,选水平:根据专业知识及参考文献知识,以及正交试验的特点,选定影响水提取法的3个因素,加水量、煎煮时间、煎煮次数,每个因素3个水平,列出因素水平表如下:
(3)选择正交表:此为3水平试验,并不考虑交互作用,有3个因素需要占据3列,预留一个空列作为误差的话,标准正交表L934是最合适的选择。
(4)表头设计:不考虑交互作用,因素可占据任意列。
(5)排出试验方案:方案及试验结果如下表,第六步省略。
(7)试验结果的方差分析:为考察试验的误差及精细效果,我们直接采用SPSS方差分析来对此试验进行结果分析。
A:方差分析的步骤
B:不考虑交互作用,只考察各因素的主效应
C:方差分析结果解读
由方差分析可知,影响因素中加水量和煎煮次数两个对提取白藜芦醇苷具有显著的影响,而煎煮时间这个因素对其的影响较小。3个因素的主次关系是:煎煮次数>加水量>煎煮时间。
D:影响因素的哪个水平最好?可以通过绘制出的图直观的看出,也可以通过邓肯氏检验来解答,这里我们仅列出直观图。
通过上图,我们可以非常直观的看出,从三个因素中选择最好的水平,得到最佳组合为A3B2C3,即加水量12,煎煮时间1.5小时,煎煮次数3次。
使用SPSS统计软件包对L9(34) 正交试验结果进行数据处理, 只要按正交表的设计格式输入实验数据, 便可获得所需的统计结果。其操作方便,直观,快捷,结果准确,使研究工作事半功倍,此法也可用来处理其他正交试验的数据。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
CDA数据分析师 出品 作者:李诗怡 一、数据分析四大思维 1. 对比思维:没有对比就没有分析 核心观点:单独一个数字没有意义,有 ...
2026-10-05Kimball 是方法,星型模型是它产出的形状。 很多人把"Kimball vs 星型模型"当成一道选择题——这本身就是个误会:Kimball 是动词 ...
2026-10-05写在开头 老板在微信上甩来一句: "帮我看下为什么销量跌了。" ” 你回工位,打开 SQL,开始写。查订单表、拉近三个月、按 ...
2026-10-03CDA数据分析师 出品 作者:李诗怡 1. 事实表 vs 维度表 对比维度 事实表 维度表 核心问题 记录“业务发生了什么事” 描述 ...
2026-10-02做数据聚合时,PySpark的groupBy()确实能完成统计,这也是它的本职工作。但它有一个根本性局限:每一组数据,最终只能返回一行 ...
2026-10-01热力地图是数据可视化中极具辨识度与实用性的空间分析图表,结合地理空间维度与数据密度特征,通过颜色深浅、色阶渐变直观展示数 ...
2026-09-30 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-09-30同样是“银行数据岗”,在国有大行总行数据中心、在一家城商行的零售部、在银行系金融科技子公司、在保险公司,工作内容、成长节 ...
2026-09-29在数据分析与统计学研究中,数据往往不是独立存在的,不同变量之间普遍存在相互关联、相互影响的关系。相关性统计分析是挖掘变量 ...
2026-09-29 导读:大多数人只把 dataclasses 当成偷懒工具,用来少写 __init__、__repr__ 这类魔法方法。但它的能力远不止于此。本文带 ...
2026-09-29 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-09-29在MySQL数据库运维与业务开发中,行业普遍存在“数据达到千万级就必须分表”的说法。但在实际生产环境中,千万条数据并不是强制 ...
2026-09-28CDA数据分析师 出品 作者:李诗怡 1. 5W1H 分析法 定义:经典系统性思维框架,通过六个核心维度对问题进行全方位拆解与剖析,确 ...
2026-09-28 很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当 ...
2026-09-28CDA数据分析师 出品 作者:李诗怡 1. 用户标签体系 定义: 通过一系列高度精炼的特征标识,对用户属性、行为与偏好进行量化刻画 ...
2026-09-24Pandas是Python生态中用于表格数据处理的核心库,广泛应用于数据清洗、统计运算、报表输出、数据分析建模等场景。在处理极大数值 ...
2026-09-24随着数字经济快速发展,数据已成为核心生产要素,各行各业的业务沉淀、用户行为、设备运行、市场交易均产生海量数据。数据处理作 ...
2026-09-24 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-09-24在时序数据分析中,大部分业务数据并非持续平稳变化,而是会在某些时间节点出现突然抬升、断崖下跌、趋势反转、波动异变等现象, ...
2026-09-23在统计学与数据分析中,研究多组数据差异最常用的方法为单因素方差分析与事后多重比较。很多数据分析初学者容易混淆两者功能,认 ...
2026-09-23