版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
试验一简介及统计整理
一、试验目的和要求
1驾驭安装、启动、主界面和退出;
2驾驭的变量定义信息;
3驾驭的数据录入及保存方法;
4驾驭在中的实现各种统计描述参数的计算。引到学生利用正确的统计方法
对数据进行适当的整理和显示,描述并探究出数据内在的数量规律性,驾
驭统计思想,培育学生学习统计学的爱好,为接着学习推断统计方法及应
用各种统计方法解决实际问题打下必要而坚实的基础。
5理解并驾驭软件包有关数据文件创建和整理的基本操作
6学习如何将收集到的数据输入计算机,建成一个正确的数据文件
7驾驭如何对原始数据文件进行整埋,包括数据查询,数据修改、删除,数
据的排序
8
试验类型:验证型;试验时间:2学时
二、试验主要仪器和设备
计算机一台,操作系统,环境。
三、试验原理
数据文件是一种结构性数据文件,由数据的结构和数据的内容两部分构
成,也可以说由变量和观测两部分构成。一个典型的数据文件如表2.1所示。
表2.1数据文件结构
变量J姓名
•••
—————
张三145•••I-
李四223•••1数据内容
观测《*
*•
*
<__________
王五245
变量的属性
中的变量共有10个属性,分别是变量名[)、变量类型()、长度()、
小数点位置()、变量名标签()、变量名值标签()、缺失值()、数据列的
显示宽度()、对其方式()和度量尺度()。定义一个变量至少要定义它的
两个属性,即变量名和变量类型,其他属性可以短暂采纳系统默认值,待以
后分析过程中假如有须要再对其进行设置。在数据编辑窗口中单击“变量视
窗”标签,进入变量视窗界面(如图2.1所示)即可对变量的各个属性进行
设置。
四、试验内容及步骤
试验L1数据文件管理
1.创建一个数据文件
数据文件的创建分成三个步骤:
(1)选择菜单【文件】一【新建】一【数据】新建一个数据文件,进入
数据编辑窗口。窗口顶部标题为“数据编辑器,
(2)单击左下角【变量视窗】标签进入变量视图界面,依据试验的设计
定义每个变量类型。
(3)变量定义完成以后,单击【数据视窗】标签进入数据视窗界面,将
每个详细的变量值录入数据库单元格内。
2.读取外部数据
当前版本的可以很简单地读取数据,步骤如下:
(1)按【文件】一【打开】一【数据】的依次运用菜单吩咐调出打开数
据对话框,在文件类型下拉列表中选择数据文件,如图2.2所示。
Lotus(*.w*)
Sylk(*.slk)
dBase(*.dbf)|
图2.2对话框
(2)选择要打开的文件,单击“打开”按钮,调出打开数据源对话框,
如图2.3所示。对话框中各选项的意义如下:
工作表下拉列表:选择被读取数据所在的工作表。
范围输入框:用于限制被读取数据在工作表中的位置
图2.5数据的保存
5.数据整理
在中,数据整理的功能主要集中在【数据】和【转换】两个主菜单下。
(1)数据排序O
对数据依据某一个或多个变量的大小排序将有利于对数据的总体阅读,基
本操作说明如下:
♦选择菜单【数据】一【排列个案工打开对话框,如图2.7所示。
(2)抽样()
在统计分析中,有时不须要对全部的观测进行分析,而可能只对某些特定的
对象有爱好。利用的吩咐可以实现这种样本筛选的功能。以安装配套数据文
件为例,选择年龄大于10的观测,基本操作说明
图2.7排列个案对话框
如下:
♦打开数据文件,选择【数据】一【选择个案】吩咐,打开对话框,如
图2.8
0选择个案I区J
夕产品数里
图2.8选择个案对话框
♦指定抽样的方式:【全部个案】不进行筛选;【假如条件满意】按指定
条件进行筛选。本例设置:产品数量>150,如图2.9所示;
B选择个案:if3
金序号产品数第»150|
夕产品数里
函数组9):
全部
算术
CDF与非中心CDFI
转损
当前日期8寸间
日期运算
日期创建
函数和特殊变量(D:
图2.9选择个案对话框
设置完成以后,点击,进入下一步。
♦确定未被选择的观测的处理方法,这里选择默认选项【过滤掉未选定
的个案】。
♦单击进行筛选,结果如图2.10
序号产品额里filters
11160001
—10150.000
311162001
412156.001
输出513179001
614179.001
⑥过速掉未选定的个案正)715151001
16157.001
将选定个案复制到新数据集8
OQ)917154001
数据集名称坦):|1018179.001
19148000
O删除未选定个案(L)122170001
1320156001
143181.001
1541S6001
165176.001
---------6148000
187198.001
198179001
209162.001
图2.10选择个案的结果
(3)增加个案的数据合并(【合并文件】一【添加个案】)
将新数据文件中的观测合并到原数据文件中,在中实现数据文件纵向合
并的方法如下:
选择菜单【数据】一【合并文件】一【添加个案工如图2.11,选择须要
追加的数据文件,单击打开按钮,弹出对话框,如图2.12。
图2.11选择个体数据来源的文件
图2.12选择变量
(4)增加变量的数据合并(【合并文件】一【添加变量】)
增加变量时指把两个或多个数据文件实现横向对接。例如将不同课程的
成果文件进行合并,收集来的数据被放置在一个新的数据文件中。在中实现
数据文件横向合并的方法如下:
选择菜单【数据】一【合并文件】一【添加变量】,选择合并的数据文件,
单击“打开”,弹出添加变量,如图2.12所示。
图2.12
♦单击执行合并吩咐。这样,两个数据文件将按观测的依次一对一地横
向合并。
(5)数据拆分()
在进行统计分析时,常常要对文件中的观测进行分组,然后按组分别进
行分析。例如要求按性别不同分组。在中详细操作如下:
♦选择菜单【数据】一【分割文件工打开对话框,如图2.13所示。
图2.13分割文件对话框
♦选择拆分数据后,输出结果的排列方式,该对话框供应了3种方式:
对全部观测进行分析,不进行拆分;在输出结果种将各组的分析结果
放在一起进行比较;按组排列输出结果,即单独显示每一分组的分析
结果。
♦选择分组变量
♦选择数据的排序方式
♦单击按钮,执行操作
(6)计算新变量
在对数据文件中的数据进行统计分析的过程中,为了更有效地处理数据
和反映事务的本质,有时须要对数据文件中的变量加工产生新的变量。比如
常常须要把几个变量加总或取加权平均数,中通过【计算】菜单吩咐来产生
这样的新变量,其步骤如下:
♦选择菜单【转换】一【计算变量工打开对话框,如图2.14所示。
圜计其变量
目标变更。):数字表达式(1):
函数组9):
□Q|全部
QS算术
CDF与韭中心CDF
QS转换
当前日期田寸间
Q回日期运算
S□I日期创建
函数和特殊变里任)
•果Q)二|(可选的个案选廨件)
)重置(6)取消帮助
图2.14对话框
♦在目标变量输入框中输入生成的新变量的变量名。单击输入框下面类型及
标签按钮,在跳出的对话框中可以对新变量的类型和标签进行设置。
♦在数字表达式输入框中输入新变量的计算表达式。例如“年龄>20”。
♦单击【假如】按钮,弹出子对话框,如图2.15所示。包含全部个体:对
全部的观测进行计算;假如个案满意条件则包括:仅对满意条件的观测进行
计算。
♦单击按钮,执行吩咐,则可以在数据文件中看到一个新生成的变量。
圈计算变量:H个案
a序号©包括所有个案®)
。如果个案篇足条件则包括(E):
0
i
3
[继续]取消帮助
图2.15假如…子对话框
试验1.2统计整理
下面给出的一个例题是来自软件自带的数据文件“”,该文件包含某公
司员工的工资、工龄、职业等变量,我们将利用此例题给出相关的描述统计
说明,本例中,我们将以员工的当前工资为例,计算该公司员工当前工资的
一些描述统计量,如均值、频数、方差等描述统计量的计算。
1.频数分析。।
基本统计分析往往从频数分析起先。通过频数分析能够了解变量取值的
状况,对把握数据的分布特征是特别有用的。比如,在某项调查中,想要知
道被调查者的性别分布状况。频数分析的第一个基本任务是编制频数分右表。
中的频数分布表包括的内容有:
(1)频数()即变量值落在某个区间中的次数。
(2)百分比()即各频数占总样本数的百分比。
।频数分析多适用于离散变量,其功能是描述离散变量的分布特征。
(3)有效百分比()即各频数占有效样本数的百分比。这里有效样本数
=总样本一缺失样本数。
(4)累计百分比()即各百分比逐级累加起来的结果。最终取值为百分
之百。
频数分析的其次个基本任务是绘制统计图.统计图是一种最为干脆的数
据刻画方式,能够特别清楚直观地展示变量的取值状况。频数分析中常用的
统计图包括:条形图,饼图,直方图等。
频数分析的应用步骤
在中的频数分析的实现步骤如下:
选择菜单”【文件】—>【打开】—>【数据】"在对话框中找到须要分
析的数据文件“”,然后选择“打开”。
选择菜单"【分析】一〉【描述统计】一〉【频率】"。如图2.1所示
图2.1对话框
确定所要分析的变量,例如年龄
在变量选择确定之后,在同一窗口上,点击“"按钮,打开统计量对话
框,如下图2.2所示,选择统计输出选项。
图2.2统计量子对话框
图2.3子对话框
结果输出及分析
点击对话框中的“"按钮,即得到下面的结果。
表2.4描述性统计量
N474
0
表2.4中给出了总样本量(N),其中变量的有效个数()为474个、缺失
值()为0。
表2.5频数分布表
21645.645.645.6
25854.454.4100.0
47-1100.0100.0
表2.5中,是频数,是按总样本量为分母计算的百分比,是以有效样本
量为分母计算的百分比,是累计百分比。
图2.5变量的条形图,图2.6变量的饼图。
3g
A25o
o
u20
m
n152
b2
a10
It5o
O
Gender
图2.5变量的条形图
Gender
图2.6变量的饼图
2.描述统计()2
2描述统计主要对定距型或定比型数据的分布特征作详细分析。
的【描述】吩咐特地用于计算各种描述统计性统计量。本节利用某年国
内上市公司的财务数据来介绍描述统计量在中的计算方法。详细操作步骤如
下:
选择菜单【分析】f【描述统计】一【描述工如图2.7所示
图2.7描述对话框
将待分析的变量移入列表框,例如将每股收益率、净资产收益率、资产
负债率等2个变量进行描述性统计,以视察上市公司股权集中度状况和负债
比率的凹凸。
,对所选择的每个变量进行标准化处理,产生相应的Z分值,作为新变
量保存在数据窗口中。其变量名为相应变量名前加前缀z。标准化计算公式:
单击【选项】按钮,如图2.8所示,选择须要计算的描述统计量。各描
述统计量同吩咐中的子对话框中大部分相同,这里不再重复。
图2.8选项子对话框
在主对话框中单击执行操作。
结果输出及分析
在结果输出窗口中给出了所选变量的相应描述统计,如表2.6所示。从
表中可以看到,我国上市公司前两大股东持股比例之比平均高达102.9,说
明“一股独大”的现象比较严峻:前五大股东持股比例之和平均为51.鸡,
资产负债率平均为46.78%。
另外,从偏态和峰度指标看出,前两大股东持股比例之比的分布呈现比
较明显的右偏,而且比较尖峭。为了验证这一结论,可以利用吩咐画出变量
z的直方图,如图2.9
表2.6描述统计量表
N*
*•
前两大股东持102.86199.122.40
3154.168.137.274
股比例之比5997464
前五大股东持315.51836.1496,602.137-318.274
股比例的平方003
和
资产负债率.1677…
315.467716o.137-.414.274
O
N()315
Histogram
A
S
U
o
n
b
a
J
L
Zscore:前豚fl球股例St匕Std.Dev.=1.0000...
图2.9变量Z的直方图
3.探究分析()
调用此过程可对变量进行更为深化详尽的描述性统计分析,故称之为探
究分析。它在一般描述性统计指标的基础上,增加有关数据其他特征的文字
及图形描述,显得更加细致及全面,对数据分析更进一步。
探究分析一般通过数据文件在分组及不分组的状况下获得常用统计量和
图形。一般以图形方式输出,直观帮助探讨者确定奇异值、影响点、还可以
进行假设检验,以及确定探讨者耍运用的某种统计方式是否合适。
在打开的数据文件上,选择如下吩咐:选择菜单“【分析】->【描述统
计】一>【探究】",打开对话框。
因变量列表;待分析的变量名称,例如将每股收益率作为探讨变量。
因子列表:从源变量框中选择一个或多个变量进入因子列表,分组变量
可以将数据依据该视察值进行分组分析。
标准个案:在源变量表中指定一个变量作为视察值的标识变量。
在输出栏中,选择两者都,表示输出图形及描述统计量。
选择[统计量]按卷少选择想耍计算的描述统计量。如图所示
’■探索:•计量I区「
画描述性
均值的一信区间6):卜51%
EM-估计里网)
□界外值(2)
百分位数(E)
画[取消]回函
对所要计算的变量的频数分布及其统计量值作图打开“对话框”,出现
如下图。
♦结果的输出及说明
(1)表
CaseProcessingSuinmaiy
Cases
VaidMissingToal
GenderNPercentNPercentNPercent
CurrentSalaryFemale216100.0%0.0%216100.0%
Male25s100.0%0.0%258100.0%
在表中可以看出有216个个体,258个个体,均无缺失值。
(2)表
•
$26,031$514.2
.9258
95%$25,018
.29
$27,045
.55
5%$25,248
.30
$24,300
.00
5712368
8.268
$7,558.
021
$15,750
$58,125
$42,375
InterquartileRange$7,013
1.863.166
4.641.330
$41,441$1,213
.78.968
95%$39,051
.19
$43,832
.37
5%$39,445
.87
$32,850
.00
3802193
36.303
$19,499
.214
$19,650
$135,00
0
$115,35
0
InterquartileRange$22,675
1.639.152
2.780.302
(3)职位员工薪水直方图显示
Histogram
forgender=Female
40
A
o
u
a
n
b
a20
l
L
10-
Mean=$26,031.92
Std.Dev.=$7,558,021
$20,000$30,000$40,000$50,000$60,000
CurrentSalary
(4)茎叶图描述
茎叶图自左向右可以分为3大部分:频数()、茎()和叶()。茎表示
数值的整数部分,叶表示数值的小数部分。每行的茎和每个叶组成的数字相
加再乘以茎宽(),即茎叶所表示的实际数值的近似值。
2.001.55
16.001.6666666666777777
14.001.88889999999999
31.002.111111111
35.002.22222222222222222222233333333333333
38.002.44444444444444444444444444555555555555
22.002.6666666666677777777777
17.002.88888899999999999
8.003.22233333
8.003.44444555
5.003.66777
2.003.88
11.000=40800)
10000
1(s)
(5)箱图
$140,000-冷
$120,000-
32
O
343
0446
$100,000-
10嘤、4504
A
J10点34
P
$80.000-
7S5
l
u
a
u
n$60,000-348371
o*468
*we
4塔42
$40,000-
$20,000-
$0—
FemaleMale
Gender
图中灰色区域的方箱为箱图的主体,上中下3条线分别表示变量值的第
75、50、25百分位数,因此变量的50%视察值落在这一区域中。
方箱中的中心粗线为中位数。箱图中的触须线是中间的纵向直线,上端截
至线为变量的最大值,下端截至线为变量的最小值。
五、试验任务
1某航空公司38名职员性别和工资状况的调杳数据,如表2.3所示,试在中
进行如下操作:
(1)将数据输入到的数据编辑窗口中,将定义为字符型变量,将定义为数值
型变量,并保存数据文件,命名为“试验
(2)插入一个变量,定义为数值型变量。
(3)将数据文件按性别分组
(4)查找工资大于40000美元的职工
(5)当工资大于40000美元时,职工的奖金是工资的20%;当工资小于40000
美元时,职工的奖金是工资的10%,假设实际收入=工资+奖金,计算全部
职工的实际收入,并添加到变量中。
表2.3某月位空公司38名职员状况的调查数据表
1M$5700020F$26250
2M$4020021F$38850
3F$21450
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 护理专升本学习计划制定
- 护理急救技能培训
- 喉梗阻患者的疼痛管理
- 儿科肺炎的护理质量评价标准
- 护理工作满意度调查
- 幼儿园活动通知
- 乳牙护理与牙齿外伤处理
- 《绝句・迟日江山丽》:意境赏析与朗读指导
- 肾内科透析患者管理考核专项|评分细则 + 模拟演练全套资料
- 《四时田园杂兴・其三十一》:意境赏析与朗读指导
- 2026北京朝阳区王四营乡人民政府编外辅助岗招聘2人笔试参考题库及答案详解
- 2026年文山州州属事业单位公开选调工作人员(37人)笔试备考试题及答案详解
- 2026贵州民航产业集团招聘试题及答案
- 2026年内蒙古自治区中考语文真题含解析
- 2026年党建知识竞赛题库含答案
- 精益管理基础消除八大浪费模板
- 2026年西交大版(新教材)初中信息科技七年级下册(全册)教学设计(附目录)
- 光储充施工安全方案
- 2026贵州建养公路技术咨询有限公司招聘6人笔试参考题库及答案详解
- 2026年应急局机关遴选面试经典题集
- 2026年医疗器械质量工程师考试试题及答案
评论
0/150
提交评论