spss数据编辑

合集下载
  1. 1、下载文档前请自行甄别文档内容的完整性,平台不提供额外的编辑、内容补充、找答案等附加服务。
  2. 2、"仅部分预览"的文档,不可在线预览部分如存在完整性等问题,可反馈申请退款(可完整预览的文档不适用该条件!)。
  3. 3、如文档侵犯您的权益,请联系客服反馈,我们会尽快为您处理(人工客服工作时间:9:00-18:30)。

1 建立数据文件

SPSS所处理的数据文件有两种来源:一是SPSS环境下建立的数据文件;二是调用其它软件建立的数据文件。

1 在SPSS数据编辑窗口建立数据文件

当用户启动SPSS后,系统首先显示一个提示窗口,询问用户要SPSS做什么时,把鼠标移至“Type in data”项上单击左键选中,然后单击“OK”按钮;或者该窗口中单击“Cancel”按钮进入SPSS数据编辑窗屏幕,如图所示。

图进入SPSS数据编辑器

(1) 数据编辑(SPSS Data Editor)界面介绍

窗口名显示栏:在窗口的顶部,显示窗口名称和编辑的数据文件名,没有文件名时显示为“Untitled-SPPS Data Editor”。

窗口控制按钮:在窗口的顶部的右上角,第一个按钮是窗口最小化,第二个按钮是窗口最大化,第三个按钮是关闭窗口。

SPSS主菜单:在窗口显示的第二行上,有:File文档,Edit编辑,View显视,Data数据,Transform转换,Analyze分析,Graphs 图形,Utilities公用项,Windows视窗。

图 SPSS窗口界面

常用工具按钮:在窗口显示的第三行上,有:打开文档,保存文档,打印,对话检索,取消当前操作,重做操作,转到图形窗口,指向记录,指定变量操作,查找,在当前记录的上方插入新的空白记录,在当前变量的左边插入新的空白变量,切分文件,设置权重单元,标记单元,显示价值标签。

数据单元格信息显示栏:在编辑显示区的上方,左边显示单元格和变量名(单元格:变量名),右边显示单元里的内容。

编辑显示区:在窗口的中部,最左边列显示单元序列号,最上边一行显示变量名称,缺省为“Var”。

编辑区选择栏:在编辑显示区下方,Data View 在编辑显示区中显示编辑数据,Variable View在编辑显示区中显示编辑数据变量信息。

状态显示栏:在窗口的底部,左边显示执行的系统命令,右边显示窗口状态。

(2) 数据文件格式

数据文件格式以每一行为一个记录,或称观察单位(Cases),每一列为一个变量(Variable)。由于SPSS不同的统计分析过程需要不同的数据类型,因此,在学习使用SPSS软件作统计分析时要注意这个问题。

现在,我们通过一个例子来学习数据的输入操作。

例:马尾松腮扁叶蜂在林间表土层的水平分布调查数据

(3) 定义变量

建立数据文件的第一步是定义变量。在数据编辑窗口左下角激活(Variable View)变量定义窗口,如下图

在数据窗口中,用户定义数据变量的名称、数据类型、宽度、小数位和标记等信息。

变量名称

输入字符(汉字和英文)作为变量的名称,本例为,样地1,样地2,样地3。如不输入名称,系统依次默认为“var00001”、“var00002”、“var00003” …。

变量应遵循下列原则:

∙在SPSS10.0中限制为8个字符长度(4个汉字);在SPSS12.0中没有限制。

∙首字符必须是字母或汉字,不能以下划线“_”或圆点“,”结尾。

∙变量不能有空格或某些特殊符号,如“!?*”等。

∙变量名不能与SPSS的关键字相同,即不能用ALL、AND、BY、EQ、GT、LE等。

变量的数据类型

当鼠标指针移至单元格,单击后该单元格的右边就会显示一个“…”按钮,单击该按钮就会显示一个数据类型设置窗口,如下图所示。

可供选择的数据类型有:

∙Numeric标准数值型,系统默认。例如: 12345.67

∙Comma逗号数值型。例如: 12,345.67 千分位用逗号

∙Dot圆点数值型。例如: 12.345,67 千分位用圆点

∙Scientific notal科学记数法。例如: 1.2E+04

∙Dat日期型,有27种形式。例如: mm/dd/yyyy

∙Dollar美元型。例如:$12345.67

∙Custom currency自定义型。例如:12345.67

∙String字符型。例如:12345.67

width指定数据字符占据的总个数(包括小数点和小数位)。

Decimal 指定小数位。

根据本例的要求,变量定义如图所示。

变量标签(Label):有的时候变量名不能正确反映变量含义,有必要给它贴上标签以便识别。这个时候,就在变量定义的标签栏里输入你的注释。

变量值标签(Values):变量值标签是用来帮助解释某些变量,特别是分类变量的数值含义。例如,有一个数值变量,0表

示女性,1表示男性。此时,为了便于识别这些数值,我们是用变量值标签。

在下图的第一个Value栏输入数值,在第二个Value栏输入数值标签。当两个输入栏输入内容后,Add按钮激活,点击它就定义了变量值标签。如本例,定义了0=女和1=男。需要修改和删除,使用Change和Remove按钮。

缺失值(Missing):缺失值是统计分析时,对数据中缺少数据的一种统计识别值。缺失值定义窗口如下图。

No missing values 没有定义缺失值,用系统默认值圆点“.”表示。

Discrete missing values 可以定义3个缺失值,例如,第一格输入“0”,表示凡为0的数据是缺失值。

Range plus one optional discrete missing value 定义取值区间为缺失值。例如,Low:为1,High:为5,Discrete value:为10,表示1至5之间的数据及数值10视为缺失值。

数据列的显示宽度(Columns): 显示数据的列宽,默认8个字符。

对齐方式(Align): 有左中右3种数据显示方式。

度量类型(Measure): 按度量精度将变量分为定量变量(Scale)、等级变量(Orsinal)和定性变量(Nominal)。该选项仅用于统计绘图时坐标轴变量的区分以及决策树模块的变量定义。定量变量,如虫口数、死亡率等;等级变量,如防治效果的好、不好等;定性变量,如害虫抗药性发生,低抗,中抗和高抗。

(4) 输入数据

变量定义完成后,在编辑区选择栏里单击“Data View”卡片,编辑显示区显示为数据编辑。在编辑区中,把与变量名相对应的数据输入到单元格里区,如下图所示。

相关文档
最新文档