京公网安备 11010802034615号
经营许可证编号:京B2-20210330
SPSS带你玩转GLM方差分析,一学就会
方差分析(Analysis of Variance,简称ANOVA),又称“变异数分析”或“F检验”,是R.A.Fisher发明的,用于两个及两个以上样本均数差别的显著性检验。它是以F值为统计量的计量资料的假设检验方法。检验方法是将总方差分解成两个或多个部分方差和,推断两组或多组的总体无数是否相等。原假设H0:多个试验组的总体均数相等,即处理因素无作用。检验水准:ɑ=0.05。
GLM(一般线性模型)一般用于完全随机设计资料的方差分析(单因素方差分析)、随机区组设计资料的方差分析(两因素方差分析)、拉丁方设计资料的方差分析、交叉设计的方差分析、析因设计的方差分析、协方差分析和重复测量的方差分析。
SPSS方差分析模块——General Linear Model
Univariate:单变量方差分析——单结局指标(y),适用多种试验设计的分析
Multivariate:多变量方差分析——多结局指标(y1,y2…yk)
Repeated:重复测量方差分析
注意单因素方差分析是1个y,1个x(三分类以上),而单变量方差分析是1个y,1个或多个x,多变量方差分析是多个y,1个或多个x。单变量方差分析包含单因素方差分析(one-way ANOVA)。
1完全随机设计资料的方差分析
完全随机设计资料的方差分析是将同质的受试对象随机地分配到各处理组,再观察其试验效应。各组样本量可以相等或不等。通过考察单因素或单变量结果一致性,获得一个因素的多个不同水平之间的关系,它也是t检验的扩展。适用条件是样本为独立随机样本,服从正态分布,各组方差齐同,单个因变量为连续变量等。
案例:
研究:3组不同药物处理(A药,B药与安慰剂),观察对糖化血红蛋白的影响。
方法:为了研究三组糖化血红蛋白水平的差异,采用one way ANOVA分析,也可以采用Univariate分析。
One-way ANOVA检验结果
Univariate分析:
SPSS操作:Analyze » General linear model » Univariate
其中,固定因子(fixed factor)是指该因子在样本中所有可能的水平都出现了,即该因子的所有水平均列出了,无需外推。随机因子(random factor)是指该因子的所有可能的水平在样本中没有都出现,需要进行外推。可见固定因子和随机因子是由试验设计决定的,所以我们可以根据试验设计的不同,将同一因素视为固定因子或随机因子均可。
在试验的设计中,协变量是一个独立变量(解释变量),不为试验者所操纵,但仍影响实验结果。在心理学、行为科学中,是指与因变量有线性相关并在探讨自变量与因变量关系时通过统计技术加以控制的变量。常用的协变量包括因变量的前测分数、人口统计学指标以及与因变量明显不同的个人特征等。
Univariate分析结果
Univariate分析结果与one way ANOVA结果完全一致!
2随机区组设计资料的方差分析
随机区组设计(randomized block design),是将受试对象按性质(如动物的性别、体重,病人的病情、性别、年龄等非试验因素)相同或相近组成b个区组,每个区组中的k个受试对象分别随机分配到k个处理组中去;区组间差别越大越好,区组内差别越小越好。随机区组设计的作用是进一步控制个体差异,检验效能高于完全随机设计的方差分析。
1.单独效应(simple effect):其他因素的水平固定时,同一因素不同水平间的差别。
2.主效应(main effect):因子不同水平设置对响应造成的差异(这时不考虑其他因子的水平设置)。
3.交互作用(interaction) :一个因子在另一个因子的不同水平下的主效应是否有差异。理解为条件主效应的差异。
案例:
原案例(完全随机对照)中,考虑各处理组(A药,B药与安慰剂)对结局(糖化血红蛋白)的影响,但糖尿病病程可能是对患者结局影响的重要混杂因素。我们可以在事先设计中,将糖尿病病程相近的36个人分成12个区组,再将每个区组的3个人随机分入3组(随机区组设计)。
随机区组设计的分析方法
One-way ANOVA只能独立分析各处理组对结局(糖化血红蛋白)的影响,无法同时分析组别(试验因素)和病程(控制因素)对结局的影响。此时应该采用Univariate分析。
Univariate分析设置:Model
对话框中选择custom(自定义模型),Main effects(主效应),TypeⅢ(常见平方和类型)。DMDuration*group为交互效应,如果没有交互一般不选择这项。
Univariate分析设置:Contrasts
Contrast选择Polynomial(多项式模型趋势检验)。
Univariate分析设置: Post Hoc
Univariate结果解读
主体间效应的检验
各组间糖化血红蛋白水平,以及各病程间糖化血红蛋白水平,以及病程对分组的交互影响不明显。
期望均方表
类似方差分析表因素变异和残差
两个模型中,假定值均相同都等于0,故参照估计值和差值相等;参照估计值和差值在线性和二次模型中均p>0.05,表明均不服从模型;按α=0.05检验水准,各组糖化不呈线性和二次模型趋势。
两两比较,同样无显著性差异。
3析因设计资料的方差分析
普通分组设计:A药与B药对比,或三组:A药, B药,安慰剂;析因设计:A药与安慰剂;B药与安慰剂。普通分组重点考察两类药物本身的对比。而析因则相对独立成组,能比较A药与安慰剂,B药与安慰剂,但一般并不比较A药与B药间差异。析因能分析A与B的交互,普通分组则不可以。
析因设计(factorial)
研究目的:观察两类药物对疾病的影响
Univariate分析设置
Univariate分析设置:Plots
Univariate分析设置:Model(参阅前文)
Univariate分析设置:Options
Univariate分析设置:contrasts(参阅前文)
Univariate分析设置: Post Hoc(参阅前文)
Univariate结果解读
各处理组间,以及drug2对糖化血红蛋白水平均无显著性影响。
凡涉及存在交互效应,或不同效应因素(随机效应,或协变量存在),都建议采用GLM方法,而并不建议用one-way ANOVA。完全随机对照可以使用one-way ANOVA,但随机区组设计和析因研究则要采用univariate方法分析。
4协方差分析
为了提高试验的精确性和准确性,对处理以外的一切条件都需要采取有效措施严加控制,使它们在各处理间尽量一致,比如随机区组设计。并且试验设计也有可能疏忽,限于试验条件的限制,因素无法掌控等,就要采用协方差分析。它是试验控制的一种辅助手段。经这种矫正,试验误差将减小,对试验处理效应估计更为准确。
1、回归:建立应变量Y随协变量X变化的线性回归关系,并利用这种回归关系把X值化为相等后再进行各组Y的修正;
实质:从Y中扣除或均衡这些不可控的协变量因素的影响后,再比较多组均数间的差别。
协方差分析应用时要注意各组协变量X与因变量Y的关系是线性的,各组回归直线平行。
推荐学习书籍
《CDA一级教材》适合CDA一级考生备考,也适合业务及数据分析岗位的从业者提升自我。完整电子版已上线CDA网校,累计已有10万+在读~

免费加入阅读:https://edu.cda.cn/goods/show/3151?targetId=5147&preview=0
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数据处理的全流程中,数据呈现与数据分析是两个紧密关联却截然不同的核心环节。无论是科研数据整理、企业业务复盘,还是日常数 ...
2026-03-06在数据分析、数据预处理场景中,dat文件是一种常见的二进制或文本格式数据文件,广泛应用于科研数据、工程数据、传感器数据等领 ...
2026-03-06在数据驱动决策的时代,CDA(Certified Data Analyst)数据分析师的核心价值,早已超越单纯的数据清洗与统计分析,而是通过数据 ...
2026-03-06在教学管理、培训数据统计、课程体系搭建等场景中,经常需要对课时数据进行排序并实现累加计算——比如,按课程章节排序,累加各 ...
2026-03-05在数据分析场景中,环比是衡量数据短期波动的核心指标——它通过对比“当前周期与上一个相邻周期”的数据,直观反映指标的月度、 ...
2026-03-05数据治理是数字化时代企业实现数据价值最大化的核心前提,而CDA(Certified Data Analyst)数据分析师作为数据全生命周期的核心 ...
2026-03-05在实验检测、质量控制、科研验证等场景中,“方法验证”是确保检测/分析结果可靠、可复用的核心环节——无论是新开发的检测方法 ...
2026-03-04在数据分析、科研实验、办公统计等场景中,我们常常需要对比两组数据的整体差异——比如两种营销策略的销售额差异、两种实验方案 ...
2026-03-04在数字化转型进入深水区的今天,企业对数据的依赖程度日益加深,而数据治理体系则是企业实现数据规范化、高质量化、价值化的核心 ...
2026-03-04在深度学习,尤其是卷积神经网络(CNN)的实操中,转置卷积(Transposed Convolution)是一个高频应用的操作——它核心用于实现 ...
2026-03-03在日常办公、数据分析、金融理财、科研统计等场景中,我们经常需要计算“平均值”来概括一组数据的整体水平——比如计算月度平均 ...
2026-03-03在数字化转型的浪潮中,数据已成为企业最核心的战略资产,而数据治理则是激活这份资产价值的前提——没有规范、高质量的数据治理 ...
2026-03-03在Excel办公中,数据透视表是汇总、分析繁杂数据的核心工具,我们常常通过它快速得到销售额汇总、人员统计、业绩分析等关键结果 ...
2026-03-02在日常办公和数据分析中,我们常常需要探究两个或多个数据之间的关联关系——比如销售额与广告投入是否正相关、员工出勤率与绩效 ...
2026-03-02在数字化运营中,时间序列数据是CDA(Certified Data Analyst)数据分析师最常接触的数据类型之一——每日的营收、每小时的用户 ...
2026-03-02在日常办公中,数据透视表是Excel、WPS等表格工具中最常用的数据分析利器——它能快速汇总繁杂数据、挖掘数据关联、生成直观报表 ...
2026-02-28有限元法(Finite Element Method, FEM)作为工程数值模拟的核心工具,已广泛应用于机械制造、航空航天、土木工程、生物医学等多 ...
2026-02-28在数字化时代,“以用户为中心”已成为企业运营的核心逻辑,而用户画像则是企业读懂用户、精准服务用户的关键载体。CDA(Certifi ...
2026-02-28在Python面向对象编程(OOP)中,类方法是构建模块化、可复用代码的核心载体,也是实现封装、继承、多态特性的关键工具。无论是 ...
2026-02-27在MySQL数据库优化中,索引是提升查询效率的核心手段—— 面对千万级、亿级数据量,合理创建索引能将查询时间从秒级压缩到毫秒级 ...
2026-02-27