京公网安备 11010802034615号
经营许可证编号:京B2-20210330
SPSS—方差分析(Analysis of Variance, ANOVA)—多因素方差分析(无重复试验双因素)
当遇到两个因素同时影响结果的情况,需要检验是一个因素起作用,还是两个因素都起作用,或者两个因素的影响都不显著
场景
某公司某种茶饮料的调查分析数据
统计了该茶饮料两种不同的包装(新设计的包装和旧的包装)在三个随机的地点的销售金额,分析销售地点和包装方式对销售金额各有怎样的影响
数学模型
无重复试验双因素的方差分析数学模型
试验区组
假设前提
构建模型
偏差平方和及其分解
检验F统计量
方差分析表
菜单
数据源
grocery_1month.sav
1
2
单变量选择
因变量
要进行分析的目标变量,一般为度量变量,数值为数值型。只能选择一个唯一变量。
固定因子
用来分组,一般是可以人为控制的
随机因子
用来分组,各个水平一般是不可以认为控制的,如体重,身高等
协变量
用于协方差分析
与因变量相关的定量变量,是用来控制其他与因子变量有关且影响方差分析的目标变量的其他干扰因素,类似回归分析中的控制变量
WLS权重
选择加权最小二乘法的权重系数
如果加权变量为0、负数或缺失,则将该个案从分析中排除。已用在模型中的变量不能用于加权变量
模型
全因子
系统默认项,用于建立全模型,分析所有因素的主效应及其交互效应,包括所有因子主效应、所有协变量主效应、所有因子间交互,但不包含协变量交互
设定
表示可以仅指定其中一部分的交互或指定因子协变量交互,必须指定要包含在模型中的所有项
因子与协变量
列出在Univariate过程中选择的所有的固定因素变量(F)、随机因素变量(R)和协变量(C)
构建项
交互: 定义进行选择变量的交互效应的方差分析
主效应:
定义进行选择变量的主效应的方差分析
表示模型中仅考虑各个控制变量的主效应而不考虑变量之间的-交互项
All 2-way - All 5-way:
定义进行所有变量的i阶交互效应的方差分析
模型
选择方差分析的主效应。若同时将因子与协变量选项中的两个变量选入,则将其交互效应强行纳入模型
平方和
定义平方和的分解方法
I 分层平凡和,仅处理主效应
II 处理所有其他效应
III 处理I和II中的所有效应
IV 要考虑所有的二维、三维、四纬的交互效应
在模型中包含截距
如果认为数据回归线可以经过坐标轴原点的话,就可以在模型中不含有截距,但是一般系统默认含有截距项
对比
用于设置比较因素水平间差异的方法
无
不进行因子各水平间的任何比较
因子变量每个水平与总平均值进行对比
简单
对因子变量各个水平与第一个水平和最后一个水平的均值进行对比
差值
表示对因子变量的各个水平都与前一个水平进行做差比较
Helmert
表示对因子变量的各个水平都与后面的水平进行做差比较,当然最后一个水平除外
重复
多项式
对每个水平按因子顺序进行趋势分析
绘制
水平轴
均数轮廓图中的横坐标
单图
用来绘制分离线的
多图
每个水平可用来创建分离图
两两比较
参考单因素方差分析,用于确定哪些均值存在差异
保存
预测值
用于保存模型为每个个案预测的值
未标准化
模型为因变量预测的值
加权
加权未标准化预测值
仅在已经选择了WLS变量的情况下可用
标准误
对于自变量具有相同值的个案所对应的因变量均值标准差的估计
残差
用于保存模型的残差
未标准化
因变量的实际值减去由模型预测的值
加权
在选择了WLS变量时提供加权的未标准化残差
标准化
对残差进行标准化的值
学生化
Student化的残差
删除
表示删除残差
诊断
用于标识自变量的值具有不寻常组合的个案和可能对模型产生很大影响的个案的测量
Cook距离
在特定个案从回归系数的计算中排除的情况下,所有个案的残差变化幅度的测量,较大的Cook距离表名从回归统计量的计算中排除个案后,系统会发生根本变化
杠杆值
未居中的杠杆值,每个观察值对模型拟合的相对影响
系数统计
用于保存模型中的参数估计值的斜方差矩阵
选项
提供一些基于固定效应模型的统计量
显示均值
输出该变量的估算边际均值、标准误等统计量
比较主效应
为模型中的任何主效应提供估计边际均值未修正的成对比较
输出
显著性水平
结果分析
描述性统计量
方差齐性检验
检验的零假设:所有组中因变量的误差方差均相等
可以认为因变量在各个因素水平下的误差方差相等
主体间效应的检验
整体模型的Sig < 0.05,此方差模型是显著的
R方 = 0.138,说明消费额的变异被“gender”,“style”,“gender*style”解释的部分有13.8%
gender(性别)对消费额有显著影响
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数字化时代,用户是产品的核心资产,用户运营的本质的是通过科学的指标监测、分析与优化,实现“拉新、促活、留存、转化、复购 ...
2026-04-15在企业数字化转型、系统架构设计、数据治理与AI落地过程中,数据模型、本体模型、业务模型是三大核心基础模型,三者相互支撑、各 ...
2026-04-15数据分析师的一天,80%的时间花在表格数据上,但80%的坑也踩在表格数据上。 如果你分不清数值型和文本型的区别,不知道数据从哪 ...
2026-04-15在人工智能与机器学习落地过程中,模型质量直接决定了应用效果的优劣——无论是分类、回归、生成式模型,还是推荐、预测类模型, ...
2026-04-14在Python网络编程、接口测试、爬虫开发等场景中,HTTP请求的发送与响应处理是核心需求。Requests库作为Python生态中最流行的HTTP ...
2026-04-14 很多新人学完Python、SQL,拿到一张Excel表还是不知从何下手。 其实,90%的商业分析问题,都藏在表格的结构里。 ” 引言:为 ...
2026-04-14在回归分析中,因子(即自变量)的筛选是构建高效、可靠回归模型的核心步骤——实际分析场景中,往往存在多个候选因子,其中部分 ...
2026-04-13在机器学习模型开发过程中,过拟合是制约模型泛化能力的核心痛点——模型过度学习训练数据中的噪声与偶然细节,导致在训练集上表 ...
2026-04-13在数据驱动商业升级的今天,商业数据分析已成为企业精细化运营、科学决策的核心手段,而一套规范、高效的商业数据分析总体流程, ...
2026-04-13主讲人简介 张冲,海归统计学硕士,CDA 认证数据分析师,前云南白药集团资深数据分析师,自媒体 Python 讲师,全网课程播放量破 ...
2026-04-13在数据可视化与业务分析中,同比分析是衡量业务发展趋势、识别周期波动的核心手段,其核心逻辑是将当前周期数据与上年同期数据进 ...
2026-04-13在机器学习模型的落地应用中,预测精度并非衡量模型可靠性的唯一标准,不确定性分析同样不可或缺。尤其是在医疗诊断、自动驾驶、 ...
2026-04-10数据本身是沉默的,唯有通过有效的呈现方式,才能让其背后的规律、趋势与价值被看见、被理解、被运用。统计制图(数据可视化)作 ...
2026-04-10在全球化深度发展的今天,跨文化传播已成为连接不同文明、促进多元共生的核心纽带,其研究核心围绕“信息传递、文化解读、意义建 ...
2026-04-09在数据可视化领域,折线图是展示时序数据、趋势变化的核心图表类型之一,其简洁的线条的能够清晰呈现数据的起伏规律。Python ECh ...
2026-04-09在数据驱动的时代,数据分析早已不是“凭经验、靠感觉”的零散操作,而是一套具备固定逻辑、标准化流程的系统方法——这就是数据 ...
2026-04-09长短期记忆网络(LSTM)作为循环神经网络(RNN)的重要改进模型,凭借其独特的门控机制(遗忘门、输入门、输出门),有效解决了 ...
2026-04-08在数据分析全流程中,数据质量是决定分析结论可靠性的核心前提,而异常值作为数据集中的“异类”,往往会干扰统计检验、模型训练 ...
2026-04-08在数字经济飞速发展的今天,数据已渗透到各行各业的核心场景,成为解读趋势、优化决策、创造价值的核心载体。而数据分析,作为挖 ...
2026-04-08在数据分析全流程中,数据处理是基础,图形可视化是核心呈现手段——前者负责将杂乱无章的原始数据转化为干净、规范、可分析的格 ...
2026-04-07