热线电话：13121318867

CDA LEVEL 1 考试，知识点汇总《一元线性回归》

2024-08-13

一、相关关系

散点图的绘制与解读、相关系数的概念与特征

用于衡量两类现象在发展变化的方向与大小方面存在一定的关联（不包括因果和共变关系）。

1.正线性相关

例如销售额中涵盖了销售利润和各类成本等，从数据大致可以看出，销售利润随着销售额的增长而增长，由于各类不确定因素，数据点基本落在直线周围，我们称之为正线性相关。

CDA LEVEL 1 考试，知识点汇总《一元<a href='/map/xianxinghuigui/' style='color:#000;font-size:inherit;'>线性回归</a>》

2.负线性相关

例如通常情况下，某地区的犯罪率越高，则该地区的房价越低，但由于供需环境等其他不确定因素，数据点基本落在直线周围，我们称之为负线性相关。

3.完全线性相关

虽然所有点都在直线上，但是我们不能说两个变量是函数关系，这是因为我们看到的是样本，并且我们假设两个变量是随机变量，而我们需要推导的是两个总体的关系。

4.非线性相关

例如虽然网站的点击量随着网站的广告投入的增加而增加，但其数据点分布在对数线周围，呈现出对数相关性。

估计标准误差与相关系数的关系

一元线性回归中，对于同一个问题，估计标准误差就意味着样本点到回归线的距离越近，那么两个变量的线性相关性就越强，相关系数越大。

二、相关系数

1.相关系数

一般情况下，如果不做特殊说明，指的就是线性相关。如果相关系数是根据变量的样本数据计算的，即为了推断总体，那么则称为样本相关系数（虽然有的时候在部分资料里并不严格说明），记为 r（有的教材里也称为Pearson相关系数）

虽然没有严格的规定，但是我们往往习惯按照下面的方式对相关性强度进行分级：

由于 r 只是样本线性相关系数，无论其数值等于多少，我们需要推断的始终是总体的相关性如何，这时候我们就需要运用显著性检验的知识了。我们运用R.A.Fisher提出的 t 检验方法来检验两个变量总体之间是否存在线性相关关系。

原假设：H0 ： ߩ = 0，两变量间无直线相关关系检验统计量：

适用条件：数据间相互独立，包括观测间相互独立与变量间相互独立；变量为连续变量（积差相关的条件）；两变量间的关系是线性的。

2.散点图提供如下特征：

（1）散点的密集程度，反应相关性的大小；

（2）散点是否具有线性关系，或线性趋势，还是其他形式，如果是其他形式是否可以转换成线性形式；

（3）线性关系之外是否存在异常值及其存在与线性趋势的哪个方向；

（4）数据是否存在稀疏问题。

3.一元线性回归方程回归分析的概念和特点

回归分析能解决什么问题？

探索影响因变量的可能因素；

利用回归模型进行预测。

三、最小二乘法

1.线性回归的基本过程

四、评价与检验

第一步：总平方和分解

第二步：计算判定系数

第三步：残差标准误

由于 SSE 是一个求和表达式。样本越多，SSE 的取值就往往会越大，因此，SSE 并不适合相对客观的反映估计值与样本值的偏离程度，我们需要将 SSE 处理成相对值。于是我们令

，其中 n-2 是自由度。这个公式可以粗略的理解为，通过除以自由度，得到残差平方的均值；再开根号则可以将方差转化成标准差，也成为估计标准误差。

第四步：线性关系检验

线性回归模型的假设

五、例题精讲

1.回归分析前，哪种数据处理是不合理的（）。 A. 标准化处理

B. 取对数处理

C. 排秩处理

D. 取整处理

答案：CD 解析：标准化可以消除数据规模的影响，对数处理往往可以解决数据正态假设的问题。

2.线性回归分析主要用于哪种情境（）。

A. 客户价值评估

B. 贷款违约识别

C. 不同班级在英语得分上是否存在差异

D. 根据用户特征进行市场细分

答案：A 解析：B项说的是逻辑回归的内容，C项是方差分析的内容，D项是说聚类分析等方法。

3.线性回归假设正确的是（）。

A. 线性：因变量与自变量间的线性关系

B. 正态性：残差必须服从正态分布

C. 独立同分布：残差间相互独立，且遵循同一分布

D. 正交假定：误差项与自变量不相关，其期望为0 答案：ABCD 解析：考察线性回归的基本假设。

4.以下关于线性回归阐述正确的是（）。

A. 如果我们建立了y关于x的线性回归方程，那么我们就可以将y变化的原因归结于x的变化。

B. 如果我们建立了y关于x的线性回归方程，在没有其他信息的情况下，我们只能说这两个变量存在线性关系。

C. 如果变量x与y无法建立线性回归方程，那就说明x和y没有关系

D. 如果想研究市场规模与市场环境因素的关系，那么我们就可以以30年的市场规模数据作为因变量y（年化数据），对应的市场环境数据作为自变量x，建立线性回归方程（共30个样本）。

答案：B 解析：A项是把关系当做因果了，C项有可能有别的非线性关系，D项更适合做面板模型，线性回归适合做截面数据。

5.回归平方和SSR反映了y的总变差中（）。

A. 由于 x 和 y 之间的线性关系引起的 y 的变化部分

B. 除了 x 和 y 之间的线性影响之外的其他因素对 y 变差的影响

C. 由于 x 和 y 之间的非线性关系引起的 y 的变化部分

D. 由于 x 和 y 之间的函数关系引起的 y 的变化部分

答案：A 解析：熟悉SSR、SSE的相关概念。

点击CDA题库链接，获取免费版CDA题库入口，祝考试顺利，快速拿证！

CDA数据分析师考试相关入口一览（建议收藏）：

▷ 想报名CDA认证考试，点击>>> “CDA报名” 了解CDA考试详情；

▷ 想学习CDA考试教材，点击>>> “CDA教材” 了解CDA考试教材；

▷ 想加入CDA考试题库，点击>>> “CDA题库” 了解CDA考试题库；

▷ 想了解CDA考试含金量，点击>>> “CDA含金量” 了解CDA考试详情；

▷ 想了解CDA院校合作，点击>>> “院校合作” 了解咨询CDA院校合作；

线性回归相关系数回归分析特征散点图方差聚类分析相关分析

数据分析咨询请扫描二维码

若不方便扫码，搜微信号：CDAshujufenxi

上一篇CDA LEVEL 1 考试，知识点汇总《市场调研》

下一篇CDA LEVEL 1 考试，知识点汇总《数据分析概述》

数据分析师考试动态

CDA报考指南

数据分析学习

数据分析师资讯

京公网安备 11010802034615号经营许可证编号：京B2-20210330

联系电话：13321103290 (微信同号)

客服在线

立即咨询

客服在线

立即咨询

免密码登录

提交首次登录验证后自动注册

CDA LEVEL 1 考试，知识点汇总《一元线性回归》

一、相关关系

二、相关系数

三、最小二乘法

四、评价与检验

五、例题精讲

数据分析师考试动态

CDA报考指南

数据分析学习

数据分析师资讯

CDA持证人专访：周婧博谈会计行业数据分析与经营诊 ...

【CDA干货】问卷调查卡方检验：原理、前提与实战应 ...

从“整体波动”到“因子归因”：CDA数据分析师视角 ...

【CDA干货】单因素方差分析：三组及以上独立样本的 ...

【CDA干货】次日付费留存计算方法、统计口径与业务 ...

从“点状静态”到“时序动态”：CDA数据分析师视角 ...

CDA持证人专访：王晓琳谈数据分析备考与秋招实战经 ...

【CDA干货】用户决策流程全解析：核心环节、影响因 ...

从“标签”到“人”：CDA数据分析师视角下的用户画 ...

【CDA干货】透视表跨表数据应用原理与实战方法 ...

【CDA干货】正态分布异常事件识别与处理方法：数据 ...

从“raw”到“ready”：CDA数据分析师视角下的标签 ...

CDA持证人专访：孙尚亮谈制造行业数据分析与生产采 ...

【CDA干货】DataFrame数据归一化：核心原理、常用方 ...

从“零散标识”到“结构资产”：CDA数据分析师视角 ...

【CDA干货】数据分析如何辅助商业谈判决策：从经验 ...

【CDA干货】T检验完整实操教程：核心原理、分类场景 ...

精准取数之道：CDA数据分析师视角下的数据查询语言 ...

CDA持证人专访：曾津谈互联网数据分析与业务赋能实 ...

【CDA干货】Pandas文本词频统计：查找关键词出现次 ...

CDA教育闭环

常见问题

关于我们

CDA数据分析师公众号

CDA考试中心小程序

CDA数据分析师App下载