京公网安备 11010802034615号
经营许可证编号:京B2-20210330
b. 使用说明
PROC ANOVA 语句的选项主要有:
DATA=数据集名 指明要分析的SAS数据集,缺省时SAS将使用最近建立的
数据集.OUTSTAT=输出数据集 指定分析计算结果输出的数据集名.
CLASS语句指明分类变量,是ANOVA过程的必需语句,并且必须出现在MODEL语句之前. 分类变量可以为数值型或字符型,分类变量的个数表示方差分析的因素个数.
MODEL语句定义分析所用的效应模型,即方差分析的因变量和效应变量. 在方差分析过程中,关键在于定义线性数学模型,常用的模型定义语句有:
MODEL y=a 单因素一元方差分析
MODEL y=a b 双因素无交互作用一元方差分析
MODEL y=a b a*b 双因素有交互作用一元方差分析
MEANS语句用来计算该语句所列的每个效应所对应的因变量均值,其选项用于设定多重比较的方法.
GLM 即广义线性模型(General Liner Model)过程,对于非平衡数据,应采用GLM过程.它使用最小二乘法对数据拟合广义线性模型. 该过程功能强大,数据分析师可用于多种不同的统计分析中. GLM过程用于方差分析时,主要语句和使用格式与上述ANOVA过程类似 .
2. 应用实例
一个工厂用三种不同的工艺生产某种电池. 从三种工艺生产的电池中分别抽取5个样品,测得样品寿命的数据如下(单位小时):
|
|
工艺1 | 工艺2 | 工艺3 |
| 1 | 40 | 26 | 39 |
| 2 | 46 | 34 | 40 |
| 3 | 38 | 30 | 43 |
| 4 | 42 | 28 | 48 |
| 5 | 44 | 30 | 44 |
我们"数据分析师"要研究的指标是电池的寿命,工艺是影响寿命的一个因素,三种工艺分别是该因素的三个水平. 在试验中我们假设其它因素都处于相同的状态. 这里我们"数据分析师"希望利用上面得到的数据来考察“工艺”的不同是否对“寿命”这个指标有影响?
sas 输入过程
Data exam;
Do I=1 to 5; /*每个处理下5次重复*/
Input x@@;
Output;
End;
End;
Cards;
40 46 38 42 44
26 34 30 28 32
39 40 43 48 50
;
Procanova; /*调用方差分析过程*/
Class trt; /*定义处理为分类变量*/
Model x=trt; /*定义效应模型*/
Title '方差分析';
Run;
sas 结果输出
Analysis of Variance Procedure
Dependent Variable: X
Source DF Sum of Squares Mean Square F Value Pr > F
Model 2 573.33333333 286.66666667 19.77 0.0002
Error 12 174.00000000 14.50000000
CT 14 747.33333333
R-Square C.V. Root MSE X Mean
0.767172 9.847982 3.80788655 38.66666667
以上结果相当于方差分析表, F值为19.77,显著性水平为0.0002,小于0.01,说明各处理间的均值差异极显著.
注:GLM过程与ANOVA应用过程类似,GLM过程中可以进行回归分析、方差分析、协方差分析、剂量反应模型分析、多元方差分析和偏相关分析等等,其功能之强大可见一斑。数据分析师培训
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
【核心关键词】贷款、报表、课程、专业、建模、缺失值、营销、互联网、银行、办公自动化、数据分析、数据预处理、特征工程、贷 ...
2026-06-05在数据库数据查询、业务报表统计、多表关联分析中,LEFT JOIN左连接是使用率最高的SQL关联查询语句。其核心特性是保留左表全部数 ...
2026-06-05 很多数据分析师能熟练地写SQL、做透视表、算描述性统计,但当被问到“如何预测用户流失概率”“如何归因销量下滑的关键因素 ...
2026-06-05任何一款产品从诞生、普及到最终退出市场,都会遵循一套固定的发展规律,这就是产品生命周期理论。在市场竞争日益激烈、产品迭代 ...
2026-06-04在Excel数据分析、办公统计、业务报表制作场景中,数据透视表是数据汇总、分类统计、快速复盘的核心工具,能够高效完成海量原始 ...
2026-06-04 很多数据分析师拿到数据就开始清洗、建模,但当被问到“这批数据属于什么类型——结构化还是非结构化?分类变量还是数值变量 ...
2026-06-04在问卷调查与社会科学数据分析中,卡方检验是最常用、最基础的非参数检验方法,广泛应用于市场调研、用户分析、行为统计、满意度 ...
2026-06-03【核心关键词】贷款、报表、课程、专业、建模、缺失值、营销、互联网、银行、办公自动化、数据分析、数据预处理、特征工程、贷 ...
2026-06-03 很多数据分析师画过趋势图、做过业绩预测,但当被问到“这个月销售额增长20%,到底是长期趋势自然增长,还是促销活动的短期 ...
2026-06-03逻辑回归是数据分析、机器学习、统计建模中应用最广泛的二分类预测模型,常用于风险判断、行为预测、归因分析等场景。在SPSS、Py ...
2026-06-02数字经济时代,市场竞争日趋同质化,用户消费需求愈发个性化、多元化,传统依托经验、粗放式、广撒网的营销模式弊端日益凸显。长 ...
2026-06-02 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-06-02在市场竞争日趋饱和、用户需求不断细分的当下,企业创业创新、产品迭代与市场拓展不再依赖经验决策,而是需要系统化、工具化的商 ...
2026-06-01【核心关键词】调度、岗位、数据库、企业、报表、培训、程序、数据分析、数据加工、业务部门、企业数据、调度工具、业务指标、 ...
2026-06-01 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-06-01在数据统计分析、数据清洗、异常值识别与数据分布研究中,箱型图是最直观、高效、专业的可视化分析工具。相较于柱状图、折线图仅 ...
2026-05-29Tkinter是Python内置的标准GUI图形界面库,具备无需额外安装、调用简单、兼容性强、轻量化高效等优势,是Python快速开发桌面小程 ...
2026-05-29 很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当 ...
2026-05-29【核心关键词】大数据、经理、专业、金融、客户、传统、建模、数据产品、互联网金融、产品经理、数据分析、金融行业、数据模型 ...
2026-05-28 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-05-28