
用SPSS做数据分析?先弄懂SPSS的基础知识吧
1、SPSS数据分析的流程
2、SPSS特性:
易用性强
操作界面极为友好,操作简单
良好的帮助系统和自学功能
为高级用户提高编程功能
功能强大
成熟的统计过程
完美的图形处理功能
提供多种数据准备技术
兼容性好
数据输入:Excel,Lotus,Oracle,SQL Server,Acess,dBASE,文本
数据输出:Word,HTML,XML,Excel,Powerpoint,PDF.
3、数据的编辑
常量
数值型常量:除了普通写法外还可以用科学计数法,如:1.3E18;
字符型常量:用单引号或双引号括起来如果字符中包含单引号,则必须使用双引号;
日期常量:日期个数的数据,一般需要使用日期函数进行转换;
变量
变量名长度不能超过8;
三种基本的类型:数值、字符和日期;
可以在variable view界面设定变量的长度及小数位、变量的描述、变量值的描述、missing值、显示宽度、对齐方式和变量的测度方式;
变量的测试方式
Scale:定距变量,如:身高、体重等;
Ordinal:定序变量,如:教育程度、级别等;
Nominal:定类变量,如:性别、民族等;
操作符与表达式
三种基本的运算:数学、关系和逻辑
数学运算符:+ – * / ** ()
关系运算符:> >= < <= = ~=
逻辑运算符:&(AND) |(OR) ~(NOT)
三种运算对应三种表达式
常用的数据操作命令
Data->Sort Cases
Transform->Rank Cases
Transform->Count
Transform->Recode
Transform->Automatic Recode
Transform->Compute
Data->Transpose
Data->Split Files
Data->Merge Files
Compute
数值型:compute num1=value.
字符型:String A(a11).compute a=’hello world’.
日期型:compute data1=date.mdy(month,day, year).
Rocode
recode variable name(old value=new value).
recode variable name(old value=new value) into new variable name.
字符型变量使用auto recode
Split file
有的时候需要对变量做些分组的分析,但一些分析方法并不提供分组变量的设置选项这就需要用到Split file命令;
例如使用 Descriptives 做描述性分析,如果想分年龄做分析,这样就可以用年龄变量做为分组变量;
可以看到这里的Split其实是分组,而不是拆分文件;
analyze all case分析所有的样本,不产生分组;
compare groups产生对比分析组;
output by groups分组输入分析结果;
Merge File
add cases 合并变量相同,但是case不同的文件;
add variables合并变量不同,case相同的文件这里的变量不同可以是部分的变量不同,case相同也可以是一个文件的case是另外一个文件的子集;
数据的分类汇总
使用Aggregate命令
指定分类变量对观测量进行分组,对每组观测量的各变量求描述统计量;
检查重复的数据
使用identify duplicate cases
数据的加权
使用weight case
选取一定的case进行分析
使用select cases:在对数据的子集进行分析的时候需要用到这个命令;
常用的数学函
取绝对值:abs(数字型表达式)
求余数函数:mod(数字型表达式,模数),模数不能为0该函数在需要对某一变量求模数的余数时使用,如果对一个顺序编号或自然数序列求模数的余数,可将该序列按模数等距分类,从而实行等距抽样;
四舍五入函数:rnd(数字型表达式)
开方函数:sqrt(数字型表达式)
四、基本的统计分析
SPSS统计分析概述:
针对不同类型的数据选取不同的分析方法,正确的分析方法是得到正确结果的关键;
spss提供数字分析和图形分析两种分析形式;
高级分析之前一般都需要做描述性统计分析,把握数据的规律对分析解释数据有很好的引导和帮助作用;
Descriptive Statistics
– Frequencies:频数分析
– Descriptives:描述统计
– Explore:探索分析
– Crosstabs:列联表分析
– Ratio:比率分析
Descriptives
– 可以对变量进行标准化;
Explore
– Explore是对连续性变量进行探索性分析最有效的工具;
– 考察数据的奇异性和分布特征;
– 箱盒图、茎叶图、正态检验图及方差齐次性检验;
Crosstabs
– 数据类型要求为分类变量;
– 二维或多维交叉频数表(列联表),分析事物(变量)之间的相互影响和关系;
– 可以做卡方检验,来分析行列变量之间是否存在相关性;
分类变量统计描述常用指标
– 统计量:
• 频数、频率、累计频数、累计频率、众数
• 比:任意两个变量之比
性别比,货物/销售人员比
构成比:部分占总体的比例
• 率:事件的发生强度
– 图形:
• 条图、饼图
Spss操作
– 单个变量的分析
• Analyze…Descriptive Statistics…Frequcencies
– 多个变量的分析
• Analyze…Descriptive Statistics…Crosstabs
– 条图
• Graph…(interactive…)bar
– 饼图
• Graph…(interactive…)pie
连续变量的描述指标
– 频数表Frequency
• 直观的方法:分布类型分布特征
– 集中趋势Central tendency
• 均数mean 中位数median 众数mode
– 离散趋势Dispersion tendency
• 全距Range
• 方差Variance 标准差std.deviation
如何计算各个描述统计量
– Analyze->Descriptive Statistics->Frequcencies…
– Analyze->Descriptive Statistics->Descriptives…
– Analyze->compare means->means…
• 如何用图形描述连续变量
– Graph…Interactive…Histogram
• 如何应用Explore对连续变量进行探索性分析
– Analyze->Descriptive Statistics->Explore…
Basic Tables过程:对分类/定量资料进行各种复杂格式的描述;
• General Tables过程:在同一张表格内同时对分类资料、连续资料和多选题数据进行汇总功能非常强大,但使用上相对复杂;CDA 数据分析师培训
• Custom Tables过程:含有表格预览窗口,并可在制表过程中控制结果;
• Multiple Response Sets/Tables过程:专门为多选题数据设计的制表过程;
• Tables of Frequencies过程:在同一张表格中对多个分类变量同时输出频数表;
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
随机森林算法的核心特点:原理、优势与应用解析 在机器学习领域,随机森林(Random Forest)作为集成学习(Ensemble Learning) ...
2025-09-05Excel 区域名定义:从基础到进阶的高效应用指南 在 Excel 数据处理中,频繁引用单元格区域(如A2:A100、B3:D20)不仅容易出错, ...
2025-09-05CDA 数据分析师:以六大分析方法构建数据驱动业务的核心能力 在数据驱动决策成为企业共识的当下,CDA(Certified Data Analyst) ...
2025-09-05SQL 日期截取:从基础方法到业务实战的全维度解析 在数据处理与业务分析中,日期数据是连接 “业务行为” 与 “时间维度” 的核 ...
2025-09-04在卷积神经网络(CNN)的发展历程中,解决 “梯度消失”“特征复用不足”“模型参数冗余” 一直是核心命题。2017 年提出的密集连 ...
2025-09-04CDA 数据分析师:驾驭数据范式,释放数据价值 在数字化转型浪潮席卷全球的当下,数据已成为企业核心生产要素。而 CDA(Certified ...
2025-09-04K-Means 聚类:无监督学习中数据分群的核心算法 在数据分析领域,当我们面对海量无标签数据(如用户行为记录、商品属性数据、图 ...
2025-09-03特征值、特征向量与主成分:数据降维背后的线性代数逻辑 在机器学习、数据分析与信号处理领域,“降维” 是破解高维数据复杂性的 ...
2025-09-03CDA 数据分析师与数据分析:解锁数据价值的关键 在数字经济高速发展的今天,数据已成为企业核心资产与社会发展的重要驱动力。无 ...
2025-09-03解析 loss.backward ():深度学习中梯度汇总与同步的自动触发核心 在深度学习模型训练流程中,loss.backward()是连接 “前向计算 ...
2025-09-02要解答 “画 K-S 图时横轴是等距还是等频” 的问题,需先明确 K-S 图的核心用途(检验样本分布与理论分布的一致性),再结合横轴 ...
2025-09-02CDA 数据分析师:助力企业破解数据需求与数据分析需求难题 在数字化浪潮席卷全球的当下,数据已成为企业核心战略资产。无论是市 ...
2025-09-02Power BI 度量值实战:基于每月收入与税金占比计算累计税金分摊金额 在企业财务分析中,税金分摊是成本核算与利润统计的核心环节 ...
2025-09-01巧用 ALTER TABLE rent ADD INDEX:租房系统数据库性能优化实践 在租房管理系统中,rent表是核心业务表之一,通常存储租赁订单信 ...
2025-09-01CDA 数据分析师:企业数字化转型的核心引擎 —— 从能力落地到价值跃迁 当数字化转型从 “选择题” 变为企业生存的 “必答题”, ...
2025-09-01数据清洗工具全景指南:从入门到进阶的实操路径 在数据驱动决策的链条中,“数据清洗” 是决定后续分析与建模有效性的 “第一道 ...
2025-08-29机器学习中的参数优化:以预测结果为核心的闭环调优路径 在机器学习模型落地中,“参数” 是连接 “数据” 与 “预测结果” 的关 ...
2025-08-29CDA 数据分析与量化策略分析流程:协同落地数据驱动价值 在数据驱动决策的实践中,“流程” 是确保价值落地的核心骨架 ——CDA ...
2025-08-29CDA含金量分析 在数字经济与人工智能深度融合的时代,数据驱动决策已成为企业核心竞争力的关键要素。CDA(Certified Data Analys ...
2025-08-28CDA认证:数据时代的职业通行证 当海通证券的交易大厅里闪烁的屏幕实时跳动着市场数据,当苏州银行的数字金融部连夜部署新的风控 ...
2025-08-28