京公网安备 11010802034615号
经营许可证编号:京B2-20210330
在单因素方差分析ANOVA中,如果该因素影响比较显著,那么需要进一步利用多重比较方法比较该因素不同水平的影响,确定不同水平下该因素的影响是否显著。常见的多重比较方法主要有两种,LSD法和Tukey HSD法。下面对R语言中,这两种多重比较方法的实现进行举例。
前期数据如下,影响因素为group,指标为value:
> head(tarD)
value group sample time
A0522W11NC1 0.0002053745 normal A0522W11NC1 11week
A0522W11NC2 0.0031773712 normal A0522W11NC2 11week
A0522W11NC3 0.0060378288 normal A0522W11NC3 11week
A0522W11NC4 0.0017626931 normal A0522W11NC4 11week
A0522W11NC5 0.0018035261 normal A0522W11NC5 11week
A0522W11NC6 0.0036690067 normal A0522W11NC6 11week
> tmp <- aov(value ~ group, tarD)
最小显著差数检验法(LSD法)
> res <- LSD.test(tmp, 'group', p.adj = 'bonferroni')
> print(res$groups)
trt means M
1 normal 2.576910e-03 a
2 drug3 7.552555e-04 b
3 drug2 7.269247e-05 b
4 high_fat 6.220610e-05 b
5 drug1 2.954733e-05 b
Tukey氏固定差距检验法(Tukey HSD)
> TukeyHSD(tmp)
Tukey multiple comparisons of means
95% family-wise confidence level
Fit: aov(formula = value ~ group, data = tarD)
$group
diff lwr upr p adj
drug2-drug1 4.314514e-05 -0.0015468705 0.0016331608 0.9999916
drug3-drug1 7.257082e-04 -0.0008643074 0.0023157239 0.6929965
high_fat-drug1 3.265877e-05 -0.0015149488 0.0015802664 0.9999969
normal-drug1 2.547362e-03 0.0009997549 0.0040949700 0.0002613
drug3-drug2 6.825631e-04 -0.0009487586 0.0023138847 0.7563196
high_fat-drug2 -1.048637e-05 -0.0016005020 0.0015795293 1.0000000
normal-drug2 2.504217e-03 0.0009142017 0.0040942330 0.0004945
high_fat-drug3 -6.930494e-04 -0.0022830651 0.0008969662 0.7277757
normal-drug3 1.821654e-03 0.0002316386 0.0034116699 0.0175538
normal-high_fat 2.514704e-03 0.0009670961 0.0040623113 0.0003161
> TukeyHSD(tmp)$group
diff lwr upr p adj
drug2-drug1 4.314514e-05 -0.0015468705 0.0016331608 0.9999915820
drug3-drug1 7.257082e-04 -0.0008643074 0.0023157239 0.6929965170
high_fat-drug1 3.265877e-05 -0.0015149488 0.0015802664 0.9999969171
normal-drug1 2.547362e-03 0.0009997549 0.0040949700 0.0002612744
drug3-drug2 6.825631e-04 -0.0009487586 0.0023138847 0.7563195891
high_fat-drug2 -1.048637e-05 -0.0016005020 0.0015795293 0.9999999705
normal-drug2 2.504217e-03 0.0009142017 0.0040942330 0.0004944674
high_fat-drug3 -6.930494e-04 -0.0022830651 0.0008969662 0.7277757202
normal-drug3 1.821654e-03 0.0002316386 0.0034116699 0.0175537862
normal-high_fat 2.514704e-03 0.0009670961 0.0040623113 0.0003161003
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
【核心关键词】贷款、报表、课程、专业、建模、缺失值、营销、互联网、银行、办公自动化、数据分析、数据预处理、特征工程、贷 ...
2026-06-05在数据库数据查询、业务报表统计、多表关联分析中,LEFT JOIN左连接是使用率最高的SQL关联查询语句。其核心特性是保留左表全部数 ...
2026-06-05 很多数据分析师能熟练地写SQL、做透视表、算描述性统计,但当被问到“如何预测用户流失概率”“如何归因销量下滑的关键因素 ...
2026-06-05任何一款产品从诞生、普及到最终退出市场,都会遵循一套固定的发展规律,这就是产品生命周期理论。在市场竞争日益激烈、产品迭代 ...
2026-06-04在Excel数据分析、办公统计、业务报表制作场景中,数据透视表是数据汇总、分类统计、快速复盘的核心工具,能够高效完成海量原始 ...
2026-06-04 很多数据分析师拿到数据就开始清洗、建模,但当被问到“这批数据属于什么类型——结构化还是非结构化?分类变量还是数值变量 ...
2026-06-04在问卷调查与社会科学数据分析中,卡方检验是最常用、最基础的非参数检验方法,广泛应用于市场调研、用户分析、行为统计、满意度 ...
2026-06-03【核心关键词】贷款、报表、课程、专业、建模、缺失值、营销、互联网、银行、办公自动化、数据分析、数据预处理、特征工程、贷 ...
2026-06-03 很多数据分析师画过趋势图、做过业绩预测,但当被问到“这个月销售额增长20%,到底是长期趋势自然增长,还是促销活动的短期 ...
2026-06-03逻辑回归是数据分析、机器学习、统计建模中应用最广泛的二分类预测模型,常用于风险判断、行为预测、归因分析等场景。在SPSS、Py ...
2026-06-02数字经济时代,市场竞争日趋同质化,用户消费需求愈发个性化、多元化,传统依托经验、粗放式、广撒网的营销模式弊端日益凸显。长 ...
2026-06-02 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-06-02在市场竞争日趋饱和、用户需求不断细分的当下,企业创业创新、产品迭代与市场拓展不再依赖经验决策,而是需要系统化、工具化的商 ...
2026-06-01【核心关键词】调度、岗位、数据库、企业、报表、培训、程序、数据分析、数据加工、业务部门、企业数据、调度工具、业务指标、 ...
2026-06-01 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-06-01在数据统计分析、数据清洗、异常值识别与数据分布研究中,箱型图是最直观、高效、专业的可视化分析工具。相较于柱状图、折线图仅 ...
2026-05-29Tkinter是Python内置的标准GUI图形界面库,具备无需额外安装、调用简单、兼容性强、轻量化高效等优势,是Python快速开发桌面小程 ...
2026-05-29 很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当 ...
2026-05-29【核心关键词】大数据、经理、专业、金融、客户、传统、建模、数据产品、互联网金融、产品经理、数据分析、金融行业、数据模型 ...
2026-05-28 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-05-28