R语言-基本数据管理合作-CDA数据分析师官网

热线电话：13121318867

R语言-基本数据管理合作

2017-06-02

R语言-基本数据管理合作

在开始数据分析之前，我们有必要按照自身对数据的需求，对数据管理。数据管理是数据分析工作的前提，只有保障数据合理、可靠、有效的获取，才能使得后续对数据的处理工作顺利开展。以下我们简单介绍一下，两种常见的数据管理方法：变量新建与重新编码，数据集的排序与合并。

1. 创建新变量

可以通过以下形式的语句，创建新变量。

变量名<-表达式

myddata<-data.frame(x1=c(2,2,6,4),x2=c(3,4,2,8))

mydata$sumx<-mydata$x1+mydata$x2

mydata$mean<-(mydata$x1+mydata$x2)/2

2. 变量的重新编码

将leadership中年龄55-75岁之间的定义为“中年人”，大于75岁的定义为“老年人”，小于55岁定义为“青年”。

leadership<-within(leadership,{

agecat<-NA

agecat[age>75]<-"Elder"

agecat[age>=55 & age <=75]<-"Middle Aged"

agecat[age<55]<-"Young"

})

3. 变量的重命名

将leadership中第6-10列的变量名称分别重命名为item1-5.

names(leadership)[6:10]<-c("item1","item2","item3","item4","item5")

也可以通过以下形式的语句，进行重命名。

rename（dataframe,c（oldname=“newname”，oldname=“newname”,..)）

4. 数据排序

将leadership各行按照女性到男性，同样性别按照年龄降序排序。

attach(leadership)

newdata<-leadership[order(gender,-age),]

dettach(leadership)

5. 数据集的合并

5.1 横向合并

多数情况下，我们需要对两个数据框进行合并，具体通过一个或者多个共有变量进行联结（即一种内联结），以下为形式语句：

total1<-merge (dataframeA,dataframeB,by="ID")

譬如：我们将学生成绩表与学校基本信息表进行合并，可以编写如下语句。

total<-merge (Studentgrade,Student,by="name")

5.2 纵向合并

此外，我们有时需要对数据纵向合并，增加样本观测值。

total2<-rbind (dataframeA,dataframeB)

CDA数据分析师考试相关入口一览（建议收藏）：

▷ 想报名CDA认证考试，点击>>> “CDA报名” 了解CDA考试详情；

▷ 想学习CDA考试教材，点击>>> “CDA教材” 了解CDA考试教材；

▷ 想加入CDA考试题库，点击>>> “CDA题库” 了解CDA考试题库；

▷ 想了解CDA考试含金量，点击>>> “CDA含金量” 了解CDA考试详情；

▷ 想了解CDA院校合作，点击>>> “院校合作” 了解咨询CDA院校合作；

数据分析 R语言

数据分析咨询请扫描二维码

若不方便扫码，搜微信号：CDAshujufenxi

上一篇回归系列（一）| 怎样正确地理解线性回归

下一篇2020美国总统竞选大戏开锣，川普当选的奇迹会再发生吗？

数据分析师考试动态

CDA报考指南

数据分析学习

数据分析师资讯

京公网安备 11010802034615号经营许可证编号：京B2-20210330

联系电话：13321103290 (微信同号)

客服在线

立即咨询

客服在线

立即咨询

免密码登录

提交首次登录验证后自动注册

R语言-基本数据管理合作

数据分析师考试动态

CDA报考指南

数据分析学习

数据分析师资讯

CDA 持证人专访：刘燕谈数据分析师业务落地与项目实 ...

【CDA干货】数据清洗核心技术体系：缺失值填充、去 ...

从“数据”到“洞察”：CDA数据分析师视角下的统计 ...

【CDA干货】指标生命周期全链路管理：从规划设计到 ...

【CDA干货】留存运营指标体系：计算口径、分析方法 ...

从“工具操作”到“方法驾驭”：CDA数据分析师视角 ...

CDA 持证人专访：杨迅谈保险行业数据产品与数据中台 ...

【CDA干货】MySQL分表数据读取：核心方案、查询优化 ...

从“凭感觉”到“有章法”：CDA数据分析师视角下的 ...

【CDA干货】面板数据聚类分析：方法原理、实操流程 ...

以指标为锚，以体系为纲：CDA数据分析师视角下的指 ...

CDA “暑期学生报名送教材” 活动已开启！ ...

【CDA干货】金融行业运营风险监测：核心统计分析方 ...

【CDA干货】基于数据分析的财险潜在客户挖掘与精准 ...

从“杂乱数据”到“分析资产”：CDA数据分析师视角 ...

CDA持证人专访：何显臻谈餐饮行业数据分析与生产管 ...

【CDA干货】如何利用统计学方法开展数据分析：流程 ...

从“数据描述”到“业务预判”：CDA数据分析师视角 ...

【CDA干货】箱线图上下限计算原理、标准流程与异常 ...

【CDA干货】MySQL固定时间间隔数据查询：语法原理、 ...

CDA教育闭环

常见问题

关于我们

CDA数据分析师公众号

CDA考试中心小程序

CDA数据分析师App下载