京公网安备 11010802034615号
经营许可证编号:京B2-20210330
SPSS分隔符格式数据文件的输入
分隔符格式文本文件的输入
我们使用Windows“记事本”创建一个显示如下格式的TEXT2.TXT的文件。
组中值,样本数,比例,累计次数,累计比例
0,7,5.56,7,15.56
1,3,6.67,10,22.22
2,8,7.78,18,40.00
3,7,5.56,25,55.56
4,7,5.56,32,71.11
5,4,8.89,36,80.00
6,2,4.44,38,84.44
7,3,6.67,41,91.11
8,3,6.67,44,97.78
该数据文件保存在配套光盘中(\SPSS\DATA\TEXT2.TXT)。
操作过程:
(1) 在主菜单中点击“File-Open-Data”命令,出现打开文件操作窗口。
(2) 在“查找范围”栏指定文本文件“TEXT2.TXT”保存的文件夹;在“文件类型”栏里,单击该输入框或者右边的下拉按钮(三角形按钮),在下拉选项里选中“Text (*.txt)”,然后在文件列表框里选中“Text2.txt”文件,再单击“打开”按钮。
(3) 出现数据引导对话窗口。
① 第一个对话窗口的设置
Does your text file match a predefined format(该文本文件是否与以前定义过的格式匹配?)
○ Yes 选择此项,则“Browse..”按钮被激活,可以将以前定义的文件调出。
⊙ No 不使用预先保存匹配的文本格式文件。
然后点击“下一步”按钮,出现文本输入向导的第二个对话窗口。
②第二个对话窗的设置
How are your variables arranged (变量间分隔方式?):
⊙Delimited: 变量间用特殊符号分隔,本例选中该项。
○Fixed width: 变量间为固定列宽度。
Are variable names included at top your file (文件顶端是否含变量名?)
⊙Yes: 文件中第1行为变量,本例选中该项。
○NO: 文件中没有变量名,系统自动给变量命名。
然后点击“下一步”按钮,出现文本输入向导的第三个对话窗口。
③第三个对话窗口的设置
The first case of data begins on which: 2 指定数据从哪一行开始,本例从第2行开始。
How are your cases represented 如何表达记录,有两种选择:
⊙Each line represents a: 每个记录占一行,本例选中该项;
○A specific number of variables represents: 多少个变量代表1个记录。
How many cases do you want to import 读入多少记录?
⊙All of the cases: 全部记录。系统默认,本例选中该项;
○The first 1000 cases: 开始的1000个记录;
○A random percentage of the cases (approximately): 随机选择一定百分比。
然后,点击下一步按钮。
④ 第四个对话窗口的设置
Which delimiters appear between variables: 变量间的分隔符号
□Tab: 制表符 □Space: 空格 Comma: 逗号,本例选中此项 □Semicolon: 分号 □Other: 自定义,将符号填入后面框里
What is the text qualifier? (字符串文本是用什么字符限制的?)
⊙ None 没有限制符,系统默认。
○ Single quote? 单引号。
○ Double quote? 双引号。
○ Other 其它字符。
⑤第五个对话窗口的设置
Specifications for variable(s) selected the data preview(设置在数据显示栏选中变量的属性):
Variable name:?? 重新定义变量名称。
Data:? 重新定义变量的数据类型。
Original Name 原来的变量名称
观察数据读取情况,重新设置变量名和变量的数据类型。
⑥第六个对话窗口的设置
Would you like to save this file format for future?(是否将文件格式保存)
○ Yes 选此项,“Save as ..”按钮激活,单击按钮后,将文件另存到指定的路径。在有相同格式文本文件时调用
它来设置。
⊙ No 不保存
Would you like to paste the syntax?(是否存为程序语句文件?)
○ Yes 选中此项,则将上述过程保存为程序文件。
⊙ No 不保存为程序语句文件,系统默认。
设置完成后,在窗口的数据显示框里观察数据读取情况,如果读出的数据不对,可以点击“上一步”按钮,回到前面的对话窗口里进行修正设置。数据显示正确后,点击“下一步”按钮。最后单击“完成”按钮,文本数据就输入到数据编辑窗里。
比较两种文本格式文件的输入结果,发现定界符格式文件的输入比较方便操作,数据类型也好掌握,因此,我们在使用数据输入时尽量采用这种格式的文本文件。数据分析培训
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
很多数据分析师画过趋势图、做过业绩预测,但当被问到“这个月销售额增长20%,到底是长期趋势自然增长,还是促销活动的短期 ...
2026-08-21在数据分析与数据可视化工作中,直方图是展示数据分布特征、离散程度、集中区间的核心图表,能够直观呈现数值数据的频次分布规律 ...
2026-08-20在数据分析领域有一句核心准则:垃圾数据进,垃圾数据出。数据清洗是数据分析、数据建模、数据可视化之前的必经前置工序,也是保 ...
2026-08-20 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-08-20在Python数据分析与数据清洗工作中,Pandas是最核心的数据处理库,DataFrame是结构化数据的标准存储格式。在实时数据采集、循环 ...
2026-08-19在零售行业大数据分析与精细化运营领域,纸尿裤旁摆放啤酒是最经典、最具代表性的商业案例。两种看似毫无关联的商品,一个是婴幼 ...
2026-08-19 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-08-19在数据分析、业务监控、质量检测与风险管控工作中,数据波动性是衡量数据稳定性、业务健康度、结果可信度的核心依据。数据波动代 ...
2026-08-18很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当导致 ...
2026-08-18在数据分析、业务评价、产品评级、用户分层与综合决策场景中,单一指标往往无法全面、客观地评价事物整体水平。现实中的评价对象 ...
2026-08-18在数理统计、假设检验、数据分析与机器学习领域中,卡方分布(χ²分布)是继正态分布、t分布之后最重要的连续型概率分布之一。 ...
2026-08-17在Python数据清洗、文本校验、账号密码规则校验、脏数据过滤、字符串规整化处理中,正则表达式是最高效、最常用的文本匹配工具。 ...
2026-08-17 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-08-17手游行业具备用户迭代快、竞争激烈、用户粘性易流失的典型特征。随着新游持续上线、玩家审美升级、玩法疲劳等问题出现,存量用户 ...
2026-08-14在数字化产品运营、商业数据分析、业务增长管理中,零散的指标统计无法支撑系统性的业务决策。单一的点击率、转化率、销量数据只 ...
2026-08-14 很多数据分析师每天都在写SQL,但当被问到“数据查询语言(DQL)的本质是什么”“SELECT语句中各子句的书写顺序与实际执行顺 ...
2026-08-14在数据库数据分析、数据清洗、报表统计与业务查询场景中,日期时间是最高频、最核心的基础字段。数据库中存储的日期格式多样,包 ...
2026-08-13在数据统计分析与数据清洗工作中,箱线图是一种简洁高效、客观性强的数据可视化图表,能够直观呈现数据集的分布特征、离散程度和 ...
2026-08-13 很多数据分析师写过无数个SELECT查询,但当被问到“如何新建一张表来固化中间数据”“创建视图和创建物理表有什么区别”“视 ...
2026-08-13在自动化办公、数据采集、定时统计、日志清理、系统监控等场景中,程序往往需要按照固定时间间隔重复执行指定任务,这种运行机制 ...
2026-08-12