京公网安备 11010802034615号
经营许可证编号:京B2-20210330
SPSS:syntax应用中临时变量的技巧
很多的时候,我们计算过程中的一些变量,一些处理结果都只是中间过渡一下,便于后面的计算和分析;还有的时候要得到分析结果少了这些临时变量又不行,今天这里简单的说说几种常用的SPSS syntax“临时变量”应用技巧。
一、临时性命令Temporary
有的时候,我们需要变换已有变量观测值计算相关结果,但又不希望改变原有数据表中的数据。例如,游戏中有个概念叫Arpu,其与游戏的平均在线人数有关,这里我们知道目前游戏的平均在线人数,预测做市场推广之后游戏平均在线人数大概有5%的增长,利用新的平均在线人数来计算收益,就可以用temporary命令来处理这个5%的问题,而不改变原有数据。下面看看temporary运用的简单示例:
----------------------------------------------------------------
#1 DATA LIST FREE /var1 var2.
#2 BEGIN DATA
#3 1 2
#4 3 4
#5 5 6
#6 7 8
#7 9 10
#8 END DATA.
#9 TEMPORARY.
#10 COMPUTE var1=var1+ 5.
#11 RECODE var2 (1 thru 5=1) (6 thru 10=2).
#12 FREQUENCIES
#13 /VARIABLES=var1 var2
#14 /STATISTICS=MEAN STDDEV MIN MAX.
#15 DESCRIPTIVES
#16 /VARIABLES=var1 var2
#17 /STATISTICS=MEAN STDDEV MIN MAX.
----------------------------------------------------------------
代码解析:
上面的代码利用temporary属性,改变var1和var2的临时值,进而计算var1\var2变换后的相关统计量。(注:temporary命令只对其后的一条命令起作用。在这个例子中,temporary只对frequencies起作用,而descriptives命令还是按原始观测值计算)
第1-8行创建一个含有var1、var2的数据集,并给var1输入1、3、5、7、9,var2输入2、4、6、8、10的观测值
第9-11行给var1、var2赋予新的值,但不改变原数据集中var1、var2的观测值
第12-17行则是Frequencies和Descriptives命令,用来描述统计VAR1和VAR2
二、临时变量#VAR
SPSS Syntax语句中所有的临时变量都是以"#"作为前缀,什么是临时变量,在SPSS中临时变量就是指运算用到,但不在结果和数据集中显现出来的变量。例如:我们要通过A计算C,但A又没办法直接计算,我们必须借助中间变量B才能达到计算目的,在整个过程中B都没明显的表现出来,那么此时B就可视为临时变量,为了方便大家更好的理解,这里还是用一个简单的例子来说明问题,示例代码如下:
---------------------------------------------------------------
#1 DATA LIST FREE / var1.
#2 BEGIN DATA
#3 1 2 3 4 5
#4 END DATA.
#5 COMPUTE var2=1.
#6 LOOP #i=1 TO var1.
#7 - COMPUTE var2=var2 * #i.
#8 END LOOP.
#9 EXECUTE.
--------------------------------------------------------------
代码解析:
上面的代码利用临时变量i做循环,通过var1计算var2,来完成一个迭代的过程。var1的初始观测值为1、2、3、4、5,var2的初始值为1,临时变量i从1取到5,通过compute命令计算出var2的值。
第1-4行创建含有var1的数据集,var1包含5个观测值
第5行对var2进行初始赋值,产生一列变量名为var2,观测值为1的变量
第6-8行为一个循环结构,循环N次计算var2的值(N为var1的观测值数)
第9行为即时计算命令execute,类似于transform菜单栏中的running pending transforms(快捷键CTRL-G)
三、其他
除了上面说的2种情况外,其他更多的情形则是伴随具体的分析方法产生的,如一次分析的结果作为下一次分析的数据,常见的如距离分析(proximities)的结果作为聚类分析(cluster)的原始数据,又或者是因子分析的结果作为回归分析的数据,都可以采用将数据结果存储为临时文件的形式来方便计算,譬如常用的matrix out和matrix in子命令就能达到如此效果,由于时间关系,这里不再深入说明。 总之,所有的临时性命令都是为了方便计算,有点类似于EXCEL中辅助列的作用。
小贴士:
TEMPORARY常与以下命令一起使用:
1)数据转换命令compute,recode,if和count,以及重复计算命令Do repeat
2)循环结构语句loop和do if
3)格式变换语句print formats,write formats和formats
4) 观测值选择加权语句select if,sample,filter和weight
5)变量声明语句numric,string以及矢量申明语句vector
6) 标签处理相关语句variable labels,value labels和missing values命令
7)文件存储语句Xsave及split file.
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在Python数据分析中,Pandas库的DataFrame是最核心、最常用的结构化数据表对象,类似于Excel的二维表格,具备规整的行列结构、字 ...
2026-09-07在数据分析、经营复盘、业绩预测与经济统计工作中,平均增速(平均增长率)是衡量数据长期变化趋势、业务发展快慢的核心指标。不 ...
2026-09-07 很多数据分析师精通Excel单元格操作,但当被问到“表结构数据的基本处理单位是什么”“字段和记录的本质区别”“为什么表结 ...
2026-09-07随着大数据技术的快速发展,商业竞争逐步从传统的经验式经营转变为数据驱动的精细化运营。海量的用户行为数据、交易数据、运营数 ...
2026-09-04CDA数据分析师 出品 作者:李诗怡 1. 波士顿矩阵(BCG Matrix) 定义: BCG于1970年提出的业务组合分析工具,以"市场增长率"(纵 ...
2026-09-04 数据分析师八成以上的时间在和数据表格打交道,但许多人拿到Excel后习惯性地先算、先分析,结果回头发现漏了一列关键数据, ...
2026-09-04数据透视表是Excel与Power BI中最核心的数据分析工具,具备快速汇总、维度拆分、动态筛选的能力,可高效完成数据归类与统计展示 ...
2026-09-03在Power BI数据分析可视化场景中,堆积柱状图+折线图是最常用的复合图表组合。堆积柱状图适合展示各细分维度当期数值、结构占比 ...
2026-09-03 很多数据分析师每天与Excel打交道,但当被问到“表格结构数据的基本处理单位是什么”“数据类型误判会引发哪些分析错误”“ ...
2026-09-03CDA数据分析师 出品 作者:李诗怡 一、8个核心数据清洗函数 1. TRIM:一键清除多余空格(最常用) 作用:仅保留文本中"单词/字 ...
2026-09-02数据分析的核心并非单纯操作工具、整理报表或绘制图表,而是依靠科学的思维逻辑挖掘数据价值、解释业务现象、指导经营决策。在完 ...
2026-09-02在社会经济、产业研究、区域治理与大数据实证分析中,面板数据是最具研究价值的数据类型。面板数据同时包含截面维度与时间维度信 ...
2026-09-02 很多数据分析师能熟练计算均值、标准差,但当被问到“如何用一张图让业务方3秒内看懂核心结论”“面对不同数据类型该怎么选 ...
2026-09-02在数据驱动决策的体系中,数据分析按照分析目的可分为描述性分析、诊断性分析、预测性分析与指导性分析四大类型。其中,诊断性分 ...
2026-09-01网络请求是Python爬虫开发、接口测试、数据拉取的核心基础功能,Python生态中主要依靠 urllib 和 requests 两大库实现HTTP请求操 ...
2026-09-01 很多数据分析师面对业务问题时,常常感到“知道要分析,却不知道用什么方法”。其实,数据分析并非无章可循——从三大基础范 ...
2026-09-01在数据库设计与业务数据维护中,自增ID是数据表最常用的主键字段,用于唯一标识每一条业务数据,正常状态下ID应保持连续递增。但 ...
2026-08-31在数理统计、数据分析、经济测算与日常量化评估中,平均值是刻画数据集中趋势、反映整体水平的基础核心指标。在实际应用中,最常 ...
2026-08-31在数据驱动的时代,数据分析早已不是“凭经验、靠感觉”的零散操作,而是一套具备固定逻辑、标准化流程的系统方法——这就是数据 ...
2026-08-31在大数据时代背景下,海量行业数据亟需通过专业化工具挖掘潜在价值,辅助企业业务决策、优化运营模式、规避经营风险。Python凭借 ...
2026-08-28