京公网安备 11010802034615号
经营许可证编号:京B2-20210330
求最优回归方程
我们应该求解只使用对目标变量真正产生影响的因子的回归方程。这是因为如果使用对目标变量不产生影响的因子,可能导致预测精确度降低。如果因子很少,求解的变量也就很少。这样,统计的变景数据很少,就可以节省时间,在实际应用中非常有效。在统计学上,仅仅使用产生影响的因子的方程叫做“最优回归方程”,或者“最优回归模型”。
求最优回归方程的步骤如下:
最优回归方程是当Ru是正数且数值最大时的组合。
接下来,说明实际操作步骤。
1、进行回归分析后,把表1的分析结果(1、2、3)代入回归方程,计算因子选择标准(Ru)为0.72l。
表1
2、接着,进行因子分析,结果如图1所示。从图1可知。影响度绝对值最小的因于是“拍卖会地点”。因此,删除所有拍卖会地点的附属项目 (“东京”、“关东(不古东京)” 、“东海”、 “近畿”、 “中国、四国、九州”)。
图1
3、对表2进行回归分析
表2
表2的目归分析结果,如表3所示。
表3
4、根据表3.得出Ru是0.726.然后以此进行因子分析,其结果如表4所示,可知影响度绝对值最小的是“AW”。
表4
把表4制成Excel柱形图,如图2所示。
图2
5、删除影响度数值最小的“AW”,再次进行回归分析。
重复操作直到目于减少为1个。这里省略对操作步骤的说明。
到目前为止。共计运行了8次回归分析。下面求8次运行结果的Ru值,并统计到表5中。
表5
把表5转换成折线图,如图3所示。
图3
使因子选择标准Ru最大的组台,就是最优回归方程。从表3 25得知,当因子数是7个时,可得最优回归方程。
因此,根据表3得出最优回归方程:
方程1
根据方程1求最高价格:
y=267.58+46.99+23.59+45.74-241.94十(-3.41)*40+6.99*22+86.30*4.5=991.60')
用同样的方法求最低价格:
y=267.58+0+O+0+0+(-3.41)*65+6.99*0+86.30x3.5=347.98"
我们的求最优回归方程和前面的几节教程是相互联系的,大家在学习的时候要从前到后的学习,这样才可以学会的。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
【核心关键词】贷款、报表、课程、专业、建模、缺失值、营销、互联网、银行、办公自动化、数据分析、数据预处理、特征工程、贷 ...
2026-06-05在数据库数据查询、业务报表统计、多表关联分析中,LEFT JOIN左连接是使用率最高的SQL关联查询语句。其核心特性是保留左表全部数 ...
2026-06-05 很多数据分析师能熟练地写SQL、做透视表、算描述性统计,但当被问到“如何预测用户流失概率”“如何归因销量下滑的关键因素 ...
2026-06-05任何一款产品从诞生、普及到最终退出市场,都会遵循一套固定的发展规律,这就是产品生命周期理论。在市场竞争日益激烈、产品迭代 ...
2026-06-04在Excel数据分析、办公统计、业务报表制作场景中,数据透视表是数据汇总、分类统计、快速复盘的核心工具,能够高效完成海量原始 ...
2026-06-04 很多数据分析师拿到数据就开始清洗、建模,但当被问到“这批数据属于什么类型——结构化还是非结构化?分类变量还是数值变量 ...
2026-06-04在问卷调查与社会科学数据分析中,卡方检验是最常用、最基础的非参数检验方法,广泛应用于市场调研、用户分析、行为统计、满意度 ...
2026-06-03【核心关键词】贷款、报表、课程、专业、建模、缺失值、营销、互联网、银行、办公自动化、数据分析、数据预处理、特征工程、贷 ...
2026-06-03 很多数据分析师画过趋势图、做过业绩预测,但当被问到“这个月销售额增长20%,到底是长期趋势自然增长,还是促销活动的短期 ...
2026-06-03逻辑回归是数据分析、机器学习、统计建模中应用最广泛的二分类预测模型,常用于风险判断、行为预测、归因分析等场景。在SPSS、Py ...
2026-06-02数字经济时代,市场竞争日趋同质化,用户消费需求愈发个性化、多元化,传统依托经验、粗放式、广撒网的营销模式弊端日益凸显。长 ...
2026-06-02 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-06-02在市场竞争日趋饱和、用户需求不断细分的当下,企业创业创新、产品迭代与市场拓展不再依赖经验决策,而是需要系统化、工具化的商 ...
2026-06-01【核心关键词】调度、岗位、数据库、企业、报表、培训、程序、数据分析、数据加工、业务部门、企业数据、调度工具、业务指标、 ...
2026-06-01 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-06-01在数据统计分析、数据清洗、异常值识别与数据分布研究中,箱型图是最直观、高效、专业的可视化分析工具。相较于柱状图、折线图仅 ...
2026-05-29Tkinter是Python内置的标准GUI图形界面库,具备无需额外安装、调用简单、兼容性强、轻量化高效等优势,是Python快速开发桌面小程 ...
2026-05-29 很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当 ...
2026-05-29【核心关键词】大数据、经理、专业、金融、客户、传统、建模、数据产品、互联网金融、产品经理、数据分析、金融行业、数据模型 ...
2026-05-28 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-05-28