京公网安备 11010802034615号
经营许可证编号:京B2-20210330
有一水稻施肥的盆栽试验,设置了5个处理:A1和A2分别施用两种不同工艺流程的氨水,A3施碳酸氢铵,A4施尿素,A5为对照。每个处理各4盆,随机置于同一试验大棚。水稻稻谷产量见下表。现分析不同施肥处理下,水稻稻谷产量之间是否有显著差异。
1.1.3 课程实习任务
①按课程设计题目要求设计脚本;
②脚本能够完成对水稻数据的单因素方差分析;
③编写代码;
④脚本分析与调试;
⑤撰写实验报告。
1.1.4 课程实习目标
①巩固并加深对R语言的理解和掌握;
②通过课外学习拓展课程知识面;
③提高运用R语言解决生活实际问题的能力;
④初步掌握开发简单脚本的基本方法;
⑤掌握书写程序设计与软件开发的阐述性、总结性文档。2. 程序设计层次及说明展示
由于采用代码注释的方法,形式上不太美观,且不容易直接看到结果,造成阅览不变,故笔者采用了将脚本文件分部分执行,截图进行说明的方法,让每部操作清晰明了,结果明显。再在本节末尾附上代码文件以供阅览。
2.1 数据录入
此处是直接进行了程序录入,将数据录入参数shuidaodata中。其中,每行数据对应一个组别。
而这里可以也可使用scan函数进行交互键入,又或者将数据保存为csv格式,再用read.csv函数根据途径录入也可以。
这里根据每行对应的类型不同分别命名。命名的列量名称为参数name,数据框名为参数shuidao。
由于水稻数据内容构成比较简单,因素单一,所以不需要再融化数据框操作了,因为在数据框形成时已经完成了融化处理的结果,再进行转化反而繁琐,故不需要使用melt函数。同理,此份水稻数据中不包含冗余成分,故也同样不需要冗杂数据处理。
此处直接使用aov函数进行单因素方差分析,得到结果参数result的F值为11.18,p值小于0.05,且各因子水平的均值之间存在十分显著差异。
经过单因素方差分析可得知,肥料因素对产量的结果影响十分显著,也因此可以再做一些步骤来确认其真实性,以及深入了解其差异性的特质。
这里先用lm函数进行线性回归模型拟合,将结果参数mo录入qqPlot函数中,得到下图:

可见回归曲线在范围内,故数据符合正态性检验。
检验正态性的方法不唯一,在网上资料查询中,还有如下方法:
1.ks.test函数,但是由于数据中包含重复数值,故前提假设不成立,不便使用。
2.W检验的shapiro.test函数,得出p值大于0.05时数据正态性得到检验。

可见水稻数据正态性依旧得到检验。
3. fBasics包里的shapiroTest函数

可见水稻数据正态性依旧得到检验。
由于数据满足正态性,故使用bartlett.test函数进行方差齐性检验,得出结果p值远大于显著性水平0.05,因此不能拒绝原假设,认为不同水平下的水稻数据是等方差的。故等方差性得到检验。
而当数据不满足正态性时,也可以使用leveneTest函数进行方差齐性检验。
为更深一步探索每组之间的差异,采用TukeyHSD函数检验,如下:

其中修改了par中的绘图参数,以便图形更加简洁清晰,绘图如下:

在这里可以清晰的看出,与0坐标线是值信水平,与其相交的部分就是效果不显著的组别,反之则是效果显著的组别。也因此可以得出结论:A1-A5、A2-A4、A3-A5、A4-A5之间有显著的差异。
同样的,在网络搜索中,还有其他的方法可以揭示组别之间的差异,此处我使用的是多重t检验法:

在这里可以清晰的看出,p值小于0.05的就是差异较为显著的组别,和上一小节的结论一致。
2.9 结论
从水稻数据的单因素方差分析结果得知,肥料因素对产量的结果影响十分显著,且结果经检验符合正态性、等方差性,故结果较为可信。
最后经过各组均值差异检测后得知,A1-A5、A2-A4、A3-A5、A4-A5四组之间差异较为显著,且由题干可知,A5为对照组,故可知A1、A3、A4三组肥料效果较好。
2.10 代码展示
#数据录入
shuidaodata<-c(24,30,28,26,
27,24,21,26,
31,28,25,30,
32,33,33,28,
21,22,16,21)
#转化为数据框
name<-rep(paste(“A”,1:5,sep=”“),each=4)
shuidao<-data.frame(name,shuidaodata)
#单因素方差分析
result<-aov(shuidaodata~name,data=shuidao)
summary(result)
#正态性检验
#Q-Q图
mo<-lm(shuidaodata~name,data=shuidao)
library(car)
qqPlot(mo,main=”Q-Qplot图”,las=T)
#W检验
#shapiro.test(shuidaodata)
#fBasics包的shapiroTest
#library(fBasics)
#shapiroTest(shuidaodata)
#方差齐性检验
bartlett.test(shuidaodata~name,data=shuidao)
#各组均值差异
#杜奇检验
duqi<-TukeyHSD(result)
par(lwd=2,cex.lab=1.5,cex.axis=1.5,col.axis=”blue”,las=1)
plot(duqi,mgp=c(3,0.5,0))
#多重t检验法
#pairwise.t.text(shuidaodata,name)
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
【核心关键词】客户、数据分析、指标体系、数据采集、数据指标、业务数据、分析思路、业务需求、分析方法 【专访摘要】本次 CDA ...
2026-07-24在数据分析、业务建模与数字化运营体系中,原始业务数据普遍存在缺失、重复、异常、口径不一致等质量问题,直接用于分析与建模会 ...
2026-07-24 很多数据分析师能熟练计算均值、标准差,但当被问到“如何用一张图让业务方3秒内看懂核心结论”“面对不同数据类型该怎么选 ...
2026-07-24在数据驱动的精细化运营体系中,指标是业务判断、效果复盘、策略优化的核心依据。随着企业数据化程度提升,指标数量持续膨胀,但 ...
2026-07-23在用户运营与产品增长体系中,留存是衡量产品真实价值与用户粘性的核心标尺,也是决定用户生命周期价值、获客投产比的底层因素。 ...
2026-07-23 很多数据分析师精通Excel、SQL、Python等工具,但当被问到“面对一个具体的业务问题,该用什么分析方法”“描述性分析和诊断 ...
2026-07-23【核心关键词】埋点、产品、互联网、数据库、决策、数据分析、产品经理、商业模式、移动互联网、指标体系、运营模块、大数据平 ...
2026-07-22在高并发、大数据量的业务系统中,单表数据量达到千万级甚至亿级后,会出现查询性能骤降、索引维护成本飙升、存储扩容困难等问题 ...
2026-07-22 很多企业团队并非缺乏指标,而是陷入“指标失控”:仪表盘上堆满实时跳动的数据,却无法回答“当前瓶颈在哪、下一步该做什么 ...
2026-07-22在金融风控、企业运营、行业研究等数据分析场景中,大量数据以面板数据形态存在:例如多家分支机构连续多个季度的风险指标、多位 ...
2026-07-21 很多数据分析师每天都在计算指标、制作报表,但当被问到“什么叫指标数据元”“指标数据标准包含哪些核心维度”“指标数据质 ...
2026-07-21一、活动介绍 2026暑期CDA备考冲刺季,为想利用假期拿证的你量身打造。考点胶囊内容搭配多重硬核福利,让你在旅行、实习、居家 ...
2026-07-21金融行业的运营风险贯穿业务全流程,涵盖交易欺诈、操作违规、流程漏洞、合规偏差、客户信用异常等多元场景,是银行、保险、证券 ...
2026-07-17财产保险作为金融行业的核心板块,涵盖车险、家财险、责任险、企财险等多元品类,是个人与企业抵御财产风险、经营风险的重要保障 ...
2026-07-17 很多数据分析师能熟练写SQL、做透视表,但当被问到“数据是从哪里来的?经过哪些加工才进入数据仓库?ETL具体做了什么?”时 ...
2026-07-17【核心关键词】模块、餐饮、客户、门店、企业、订单、供应链、多样化、产品、生产计划、数据分析、生产管理、物料管理、业务分 ...
2026-07-16在数字化分析时代,原始数据本身不具备业务价值,只有通过科学的统计学方法加工、拆解、验证与解读,才能挖掘数据背后的规律、差 ...
2026-07-16 很多数据分析师能熟练地写SQL、做透视表、算描述性统计,但当被问到“如何预测用户流失概率”“如何归因销量下滑的关键因素 ...
2026-07-16在描述性统计分析、数据预处理、异常值排查与多组数据分布对比工作中,箱线图(Box Plot)是应用最广泛的可视化与统计工具之一。 ...
2026-07-15在企业数据存储、业务统计与数据分析工作中,绝大多数业务数据都带有时间维度属性,例如订单创建时间、用户注册时间、支付完成时 ...
2026-07-15