京公网安备 11010802034615号
经营许可证编号:京B2-20210330
在单因素方差分析ANOVA中,如果该因素影响比较显著,那么需要进一步利用多重比较方法比较该因素不同水平的影响,确定不同水平下该因素的影响是否显著。常见的多重比较方法主要有两种,LSD法和Tukey HSD法。下面对R语言中,这两种多重比较方法的实现进行举例。
前期数据如下,影响因素为group,指标为value:
> head(tarD)
value group sample time
A0522W11NC1 0.0002053745 normal A0522W11NC1 11week
A0522W11NC2 0.0031773712 normal A0522W11NC2 11week
A0522W11NC3 0.0060378288 normal A0522W11NC3 11week
A0522W11NC4 0.0017626931 normal A0522W11NC4 11week
A0522W11NC5 0.0018035261 normal A0522W11NC5 11week
A0522W11NC6 0.0036690067 normal A0522W11NC6 11week
> tmp <- aov(value ~ group, tarD)
最小显著差数检验法(LSD法)
> res <- LSD.test(tmp, 'group', p.adj = 'bonferroni')
> print(res$groups)
trt means M
1 normal 2.576910e-03 a
2 drug3 7.552555e-04 b
3 drug2 7.269247e-05 b
4 high_fat 6.220610e-05 b
5 drug1 2.954733e-05 b
Tukey氏固定差距检验法(Tukey HSD)
> TukeyHSD(tmp)
Tukey multiple comparisons of means
95% family-wise confidence level
Fit: aov(formula = value ~ group, data = tarD)
$group
diff lwr upr p adj
drug2-drug1 4.314514e-05 -0.0015468705 0.0016331608 0.9999916
drug3-drug1 7.257082e-04 -0.0008643074 0.0023157239 0.6929965
high_fat-drug1 3.265877e-05 -0.0015149488 0.0015802664 0.9999969
normal-drug1 2.547362e-03 0.0009997549 0.0040949700 0.0002613
drug3-drug2 6.825631e-04 -0.0009487586 0.0023138847 0.7563196
high_fat-drug2 -1.048637e-05 -0.0016005020 0.0015795293 1.0000000
normal-drug2 2.504217e-03 0.0009142017 0.0040942330 0.0004945
high_fat-drug3 -6.930494e-04 -0.0022830651 0.0008969662 0.7277757
normal-drug3 1.821654e-03 0.0002316386 0.0034116699 0.0175538
normal-high_fat 2.514704e-03 0.0009670961 0.0040623113 0.0003161
> TukeyHSD(tmp)$group
diff lwr upr p adj
drug2-drug1 4.314514e-05 -0.0015468705 0.0016331608 0.9999915820
drug3-drug1 7.257082e-04 -0.0008643074 0.0023157239 0.6929965170
high_fat-drug1 3.265877e-05 -0.0015149488 0.0015802664 0.9999969171
normal-drug1 2.547362e-03 0.0009997549 0.0040949700 0.0002612744
drug3-drug2 6.825631e-04 -0.0009487586 0.0023138847 0.7563195891
high_fat-drug2 -1.048637e-05 -0.0016005020 0.0015795293 0.9999999705
normal-drug2 2.504217e-03 0.0009142017 0.0040942330 0.0004944674
high_fat-drug3 -6.930494e-04 -0.0022830651 0.0008969662 0.7277757202
normal-drug3 1.821654e-03 0.0002316386 0.0034116699 0.0175537862
normal-high_fat 2.514704e-03 0.0009670961 0.0040623113 0.0003161003
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在Python数据分析中,Pandas库的DataFrame是最核心、最常用的结构化数据表对象,类似于Excel的二维表格,具备规整的行列结构、字 ...
2026-09-07在数据分析、经营复盘、业绩预测与经济统计工作中,平均增速(平均增长率)是衡量数据长期变化趋势、业务发展快慢的核心指标。不 ...
2026-09-07 很多数据分析师精通Excel单元格操作,但当被问到“表结构数据的基本处理单位是什么”“字段和记录的本质区别”“为什么表结 ...
2026-09-07随着大数据技术的快速发展,商业竞争逐步从传统的经验式经营转变为数据驱动的精细化运营。海量的用户行为数据、交易数据、运营数 ...
2026-09-04CDA数据分析师 出品 作者:李诗怡 1. 波士顿矩阵(BCG Matrix) 定义: BCG于1970年提出的业务组合分析工具,以"市场增长率"(纵 ...
2026-09-04 数据分析师八成以上的时间在和数据表格打交道,但许多人拿到Excel后习惯性地先算、先分析,结果回头发现漏了一列关键数据, ...
2026-09-04数据透视表是Excel与Power BI中最核心的数据分析工具,具备快速汇总、维度拆分、动态筛选的能力,可高效完成数据归类与统计展示 ...
2026-09-03在Power BI数据分析可视化场景中,堆积柱状图+折线图是最常用的复合图表组合。堆积柱状图适合展示各细分维度当期数值、结构占比 ...
2026-09-03 很多数据分析师每天与Excel打交道,但当被问到“表格结构数据的基本处理单位是什么”“数据类型误判会引发哪些分析错误”“ ...
2026-09-03CDA数据分析师 出品 作者:李诗怡 一、8个核心数据清洗函数 1. TRIM:一键清除多余空格(最常用) 作用:仅保留文本中"单词/字 ...
2026-09-02数据分析的核心并非单纯操作工具、整理报表或绘制图表,而是依靠科学的思维逻辑挖掘数据价值、解释业务现象、指导经营决策。在完 ...
2026-09-02在社会经济、产业研究、区域治理与大数据实证分析中,面板数据是最具研究价值的数据类型。面板数据同时包含截面维度与时间维度信 ...
2026-09-02 很多数据分析师能熟练计算均值、标准差,但当被问到“如何用一张图让业务方3秒内看懂核心结论”“面对不同数据类型该怎么选 ...
2026-09-02在数据驱动决策的体系中,数据分析按照分析目的可分为描述性分析、诊断性分析、预测性分析与指导性分析四大类型。其中,诊断性分 ...
2026-09-01网络请求是Python爬虫开发、接口测试、数据拉取的核心基础功能,Python生态中主要依靠 urllib 和 requests 两大库实现HTTP请求操 ...
2026-09-01 很多数据分析师面对业务问题时,常常感到“知道要分析,却不知道用什么方法”。其实,数据分析并非无章可循——从三大基础范 ...
2026-09-01在数据库设计与业务数据维护中,自增ID是数据表最常用的主键字段,用于唯一标识每一条业务数据,正常状态下ID应保持连续递增。但 ...
2026-08-31在数理统计、数据分析、经济测算与日常量化评估中,平均值是刻画数据集中趋势、反映整体水平的基础核心指标。在实际应用中,最常 ...
2026-08-31在数据驱动的时代,数据分析早已不是“凭经验、靠感觉”的零散操作,而是一套具备固定逻辑、标准化流程的系统方法——这就是数据 ...
2026-08-31在大数据时代背景下,海量行业数据亟需通过专业化工具挖掘潜在价值,辅助企业业务决策、优化运营模式、规避经营风险。Python凭借 ...
2026-08-28