京公网安备 11010802034615号
经营许可证编号:京B2-20210330
SPSS分析技术:非线性回归;科学种田!肥料应该用多少合适
非线性回归
非线性关系可以分为本质是线性关系的非线性关系和完全非线性关系,有点拗口。在曲线回归总已经介绍,可以通过变量装换,转化为线性关系,并进行线性回归分析的就是本质是线性关系的非线性关系。如果无法通过变量装换,转化为线性关系,无法进行线性回归分析的叫完全非线性关系。今天我们介绍的非线性关系就是完全非线性关系的回归分析。
非线性回归的优势
曲线估计只能用于一个自变量和因变量相关关系的模型的分析,而非线性回归分析可以用来探讨因变量和一组自变量之间的非线性相关模型。非线性回归可以估计因变量和自变量之间任意关系的模型,可以根据自身需要随意设定估计方程的具体形式。因此,非线性回归在实际应用中价值更大,应用范围更广。
非线性回归模型
范例分析
某省农科院新培育了一种高产量农作物,并在海南的试验田中进行实验种植,现有试验田施肥量及其对应的农作物产量数据,根据该数据文件推定施肥量与产量之间的关系。
分析步骤
1、做散点图,观察施肥量与农作物产量的关系;选择菜单【图形】-【旧对话框】-【散点/点状】,将施肥量选为自变量,产量选为因变量。
2、 估计初始值;根据上图,施肥量和产量之间似乎存在线性关系。但是根据实际经验可知,这种推断不正确。因为作物产量不可能随着施肥量的增加而一直增加下去,当产量达到一定水平时,施肥量的增加不会带来产量的进一步提高,二者的关系可以用渐进回归模型:
要确定回归方程,首要估算出参数b1、b2、b3的初始值。由散点图看出,产量最大值接近13,不妨设b1=13;x=0时,y=6,故b2=6-13=-7;b3为散点图中两个分隔较宽的点之间的连线的斜率的倒数,在此取b3=-1.5。
3、参数设置;选择【分析】-【回归】-【非线性】菜单,打开非线性回归对话框。按照下图输入数据。
4、损失函数设置;单击“损失”,设置损失函数。所谓损失函数是指一个包括当前工作文件中的变量以及所设定的参数并通过计算法使之最小化的函数。系统默认状态下,非线性回归过程根据算法将残差平方和最小化为损失函数。如果选择“用户定义的损失函数”,可以再“用户定义的损失函数”列表框中键入或者粘贴一个表达式。字符串常数必须包含在引号或撇号中,数字常数必须按以美式格式键入,并用句点作为小数分隔符。本案例选择系统默认设置。单击“继续”。
5、 参数约束设置;单击“约束,定义参数约束。“约束”是在对解的迭代搜索过程中对参数所允许值的限制。该对话框有两个设置选项:“未约束”和“定义参数约束”。
6、 保存设置;单击“保存”,该对话框提供4种用于保存的数据类型,允许作为新变量的观测值保存于当前文件中。
7、算法选项设置;单击“选项”,该对话框用于设置参数估计的算法和算法的迭代次数、迭代步长和收敛条件等。
结果解释
1、 如上图所示,该案例经过多大20步的迭代估计之后,找到模型的最优解,即 b1、b2、b3的参数估计值13.348、-10.783和-0.418,此外还得到了三个参数值的标准误差和95%置信区间,以及三个参数估计值的相关系数,可以看出各个参数值之间的相关性很高,尤其是b1和b3的相关系数达到0.968,属非常显著的相关关系。
2、 根据上表回归模型的方差分析结果,表中回归行的平方和代表该回归模型所能解释的模型的方差变化,而残差行的平方和代表该非线性回归模型所不能解释的方差变化。二者的和即为未修正的总计,它是总的残差平方和,而R2=1-(残差平方和)/(已更正的平方和)=0.907,说明该模型能解释因变量90.7%的变异量,即该非线性模型的拟合优度很高。根据以上分析可以确定,该分析所获得的回归模型显著。
根据线性回归模型:
可得回归方程:
从散点图可以知道,目前采集到的数据还不足够,因为图中没有出现明显的平缓趋势。为了找到最合适的施肥量,可以通过得到的回归方程,做出自变量(施肥量)范围更广的曲线,找出曲线的平缓位置,这个位置对应的横轴值就是合理的施肥量。数据分析培训
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
当沃尔玛数据分析师首次发现 “啤酒与尿布” 的高频共现规律时,他们揭开了数据挖掘最迷人的面纱 —— 那些隐藏在消费行为背后 ...
2025-11-03这个问题精准切中了配对样本统计检验的核心差异点,理解二者区别是避免统计方法误用的关键。核心结论是:stats.ttest_rel(配对 ...
2025-11-03在 CDA(Certified Data Analyst)数据分析师的工作中,“高维数据的潜在规律挖掘” 是进阶需求 —— 例如用户行为包含 “浏览次 ...
2025-11-03在 MySQL 数据查询中,“按顺序计数” 是高频需求 —— 例如 “统计近 7 天每日订单量”“按用户 ID 顺序展示消费记录”“按产品 ...
2025-10-31在数据分析中,“累计百分比” 是衡量 “部分与整体关系” 的核心指标 —— 它通过 “逐步累加的占比”,直观呈现数据的分布特征 ...
2025-10-31在 CDA(Certified Data Analyst)数据分析师的工作中,“二分类预测” 是高频需求 —— 例如 “预测用户是否会流失”“判断客户 ...
2025-10-31在 MySQL 实际应用中,“频繁写入同一表” 是常见场景 —— 如实时日志存储(用户操作日志、系统运行日志)、高频交易记录(支付 ...
2025-10-30为帮助教育工作者、研究者科学分析 “班级规模” 与 “平均成绩” 的关联关系,我将从相关系数的核心定义与类型切入,详解 “数 ...
2025-10-30对 CDA(Certified Data Analyst)数据分析师而言,“相关系数” 不是简单的数字计算,而是 “从业务问题出发,量化变量间关联强 ...
2025-10-30在构建前向神经网络(Feedforward Neural Network,简称 FNN)时,“隐藏层数目设多少?每个隐藏层该放多少个神经元?” 是每个 ...
2025-10-29这个问题切中了 Excel 用户的常见困惑 —— 将 “数据可视化工具” 与 “数据挖掘算法” 的功能边界混淆。核心结论是:Excel 透 ...
2025-10-29在 CDA(Certified Data Analyst)数据分析师的工作中,“多组数据差异验证” 是高频需求 —— 例如 “3 家门店的销售额是否有显 ...
2025-10-29在数据分析中,“正态分布” 是许多统计方法(如 t 检验、方差分析、线性回归)的核心假设 —— 数据符合正态分布时,统计检验的 ...
2025-10-28箱线图(Box Plot)作为展示数据分布的核心统计图表,能直观呈现数据的中位数、四分位数、离散程度与异常值,是质量控制、实验分 ...
2025-10-28在 CDA(Certified Data Analyst)数据分析师的工作中,“分类变量关联分析” 是高频需求 —— 例如 “用户性别是否影响支付方式 ...
2025-10-28在数据可视化领域,单一图表往往难以承载多维度信息 —— 力导向图擅长展现节点间的关联结构与空间分布,却无法直观呈现 “流量 ...
2025-10-27这个问题问到了 Tableau 中两个核心行级函数的经典组合,理解它能帮你快速实现 “相对位置占比” 的分析需求。“index ()/size ( ...
2025-10-27对 CDA(Certified Data Analyst)数据分析师而言,“假设检验” 绝非 “套用统计公式的机械操作”,而是 “将模糊的业务猜想转 ...
2025-10-27在数字化运营中,“凭感觉做决策” 早已成为过去式 —— 运营指标作为业务增长的 “晴雨表” 与 “导航仪”,直接决定了运营动作 ...
2025-10-24在卷积神经网络(CNN)的训练中,“卷积层(Conv)后是否添加归一化(如 BN、LN)和激活函数(如 ReLU、GELU)” 是每个开发者都 ...
2025-10-24