




版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
1、关于某公司 474 名职工综合状况的统计分析报告一、 数据介绍:本次分析的数据为某公司 474 名职工状况统计表,其中共包含十一变量,分别是:id (职工编号),gender(性别),bdate(出生日期),edcu (受教育水 平程度), jobcat (职务等级) , salbegin (起始工资) , salary (现工资) , jobtime( 本单位工作经历 月), prevexp( 以前工作经历 月), minority( 民族 类型),age(年龄)。通过运用spss统计软件,对变量进行频数分析、描述性统 计、方差分析、相关分析、以了解该公司职工上述方面的综合状况,并分析个 变
2、量的分布特点及相互间的关系。二、 数据分析1、频数分析 。基本的统计分析往往从频数分析开始。通过频数分析能够了解变量的取值状况,对把握数据的分布特征非常有用。此次分析利用了某公 司474名职工基本状况的统计数据表,在 gender(性别)、edcu (受教育水平 程度)、不同的状况下的频数分析, 从而了解该公司职工的男女职工数量、 受 教育状况的基本分布。Statistics首先,对该公司的男女性别分布进行频数分析,结果如下:GenderGenderNValid474nalLevel(years)474EducatioMiss ing00FrequencyPerce n tValidPerce
3、 ntCumulati ve Perce ntVal Femal id eMaleTotal21625847445.654.4100.045.654.4100.045.6100.0上表说明,在该公司的474名职工中,有216名女性,258名男性,男女比例 分别为45.6%和54.4%,该公司职工男女数量差距不大,男性略多于女性。其次对原有数据中的受教育程度进行频数分析,结果如下表Educati onal Level (years)FrequencyPerce ntValidPerce ntCumulati ve Perce ntVal id85311.211.211.21219040.140.
4、151.31461.31.352.51511624.524.577.0165912.412.489.517112.32.391.81891.91.993.719275.75.799.4202.4.499.8211.2.2100.0Tot474100.0100.0alH is to g r a mEducatio nal Le vel (years)上表及其直方图说明,被调查的474名职工中,受过12年教育的职工是该组频数最高的,为190 人,占总人数的40.1%,其次为15年,共有116人,占中人数的24.5%。且接受过 高于20年的教育的人数只有1人,比例很低。2、描述统计分析。再通过简单的
5、频数统计分析了解了职工在性别和受教育水平上的总体分布状况后,我们还需要对数据中的其他变量特征有更为精确的认识,这就需要通过计算基本描述统计的方法来实现。下面就对各个变量 进行描述统计分析,得到它们的均值、标准差、片度峰度等数据,以进一步 把我数据的集中趋势和离散趋势。Descriptive StstisticsNMi nimu m Maximu mMea nStd.DeviationSkew nessKurtosis1StdStdStatisStatisStatisStatistStatistStatis.Statis.ticticticicicticErrticErrororEducatio
6、nal47482113.492.885-.114.11-.265.22Level24(years)Curre nt474$15,75$135,0$34,419$17,0752.125.115.378.22Salary000.57.66124Begi nni$79,98$17,016$7,870.11.22ng474$9,0000.096382.853212.3904Salary1Previou474047695.86104.5861.510.111.696.22sExperie nee(mo nths)24Mon ths sin eeHire474639881.1110.061-.053.11
7、2-1.153.224如表所示,以起始工资为例读取分析结果,474名职工的起始工资最小值为$ 9000,最大值为$ 79980,平均起始工资为$ 17016,标准差为$ 7870.638, 偏度系数和峰度系数分别为2.853和12.390。其他数据依此读取,则该表表明474 名职工的受教育水平、起始工资、现工资、先前工作经验、现在工作经验的详 细分布状况。3、Exploratory data an alysis。(1)交叉分析。通过频数分析能够掌握单个变量的数据分布情况,但是在实际分析中,不仅要 了解单个变量的分布特征,还要分析多个变量不同取值下的分布,掌握多个变 量的联合分布特征,进而分析变
8、量之间的相互影响和关系。就本数据而言,需 要了解现工资与性别、年龄、受教育水平、起始工资、本单位工作经历、以前 工作经历、职务等级的交叉分析。现以现工资与职务等级的列联表分析为例, 读取数据(下面数据分析表为截取的一部分):单因素分析用来研究一个控制变量的不同水平是否对观测变量产生了显着 影响。下面我们把受教育水平和起始工资作为控制变量,现工资为观测变量, 通过单因素方差分析方法研究受教育水平和起始工资对现工资的影响进行分 析。分析结果如下:上表是起始工资对现工资的单因素方差分析结果。 可以看出: F 统计量的观测值 为 33.040,对应的概率 P 值近似等于 0,如果显着性水平为 0.05
9、 ,由于概率值 P小于显着性水平q,则应拒绝原假设,认为不同的起始工资对现工资产生了显 着影响。同理,上表是受教育水平对现工资影响的单因素分析结果,其结果亦为拒绝原 假设,所以不同的受教育水平对现工资产生显着影响。4、相关分析。 相关分析是分析客观事物之间关系的数量分析法,明确客观 事物之间有怎样的关系对理解和运用相关分析是极其重要的。函数关系是指两事物之间的一种一一对应的关系,即当一个变量 X 取一定 值时,另一个变量函数 Y 可以根据确定的函数取一定的值。另一种普遍存在的 关系是统计关系。统计关系是指两事物之间的一种非一一对应的关系,即当一 个变量 X 取一定值时,另一个变量 Y 无法根据
10、确定的函数取一定的值。统计关 系可分为线性关系和非线性关系。事物之间的函数关系比较容易分析和测度,而事物之间的统计关系却不像 函数关系那样直接,但确实普遍存在,并且有的关系强有的关系弱,程度各有 差异。如何测度事物之间的统计关系的强弱是人们关注的问题。相关分析正是种 简 单 易 行 的 测 度 事 物 之 间 统 计 关 系 的CorrelationsCurrent SalaryBeginningSalaryMonths since HirePrevious Experience(months)YearsCurrent SalaryPearson Correlation1.880*.084-.
11、097*-.144*Sig. (2-tailed).000.067.034.002N474474474474473Beginning SalaryPearson Correlation.880*1-.020.045-.010Sig. (2-tailed).000.668.327.833N474474474474473Months since HirePearson Correlation.084-.0201.003:.054Sig. (2-tailed).067.668.948.244N474474474474473Previous ExperiencePearson Correlation-
12、.097*.045.0031.802*(months)Sig. (2-tailed).034.327.948.000N474474474474473YearsPearson Correlation-.144*-.010.054.802*1Sig. (2-tailed).002.833.244.000N473473473473473*. Correlation is significant at the 0.01 level (2-tailed).*. Correlation is significant at the 0.05 level (2-tailed).上表是对本次分析数据中,现工资、
13、起始工资、本单位工作时间、以前工作时间、年龄五个变量间的相关分析,表中相关系数旁边有两个星号(*)的,表示显着性水平为0.01时,仍拒绝原假设。一个星号(*)表示显着性水平为 0.05是仍拒绝原假设。先以现工资这一变量与其他变量的相关性为例分析,由 上表可知,现工资与起始工资的相关性最大,相关系数为0.880,而与在本单位的工作时间相关性最小,相关系数为0.084。5、参数检验。首先对现工资的分布做正态性检验,结果如下:由上图可知,现工资的分布可近似看作符合正态分布,现推断现工资变量的平 均值是否为$3,000,0,因此可采取单样本t检验来进行分析。分析如下:On e-Sample Stati
14、sticsStd.Std.DeviatioErrorNMea nnMea nOn e-Sample TestTest Value=3000095% Co nfide neeSig.Mea nIn tervalof the(2-taileDiffereDiffere neetdfd)neeLowerUpperCurre nt5.635473.000$4,419.$2,878$5,960Salary568.40.73由One-Sample Statistics 可知,474名职工的现工资平均值为Y 34,419.57 , 标准差为$17,075.661,均值标准误差为$784.311。图表One-Sample Test中, 第二列是t统计量的观测值为5.635 ;第三列是自由度为473( n-1);第四列是 t统计量观测值的双尾概率值;第五列是样本均值和检验值的差;第六列和第七 列是总体均值与原假设值差的 95%勺置信区间为($2,878.40,5,960.73 )。该 问题的t值等于5.635对应的临界置信水平为0,远远小于设置的0.05,因此 拒绝原假设,表明该公司的474名职工的现工资与$3,000,0存在显着差异。6、非参数检验。对本数据中的年龄做正态分布检验,结果如下:由上图两图可知,474名职工的年龄分布并不完全符合正态分布,所以现推断
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 热点练14 议论文阅读论据位置判断及分析-2024年中考语文专练(原卷版)
- 暑假综合提升试题-2025年暑假人教版七年级数学下册
- 人工智能通识教程(微课版) 课件 04 人工智能技术的觉醒-深度学习技术框架 02
- CN120197571A 应用于pocv分析模式的时钟网格仿真时序标注方法及装置
- 老人肠道养护知识培训课件
- 宇宏健康花城消防施工合同2篇
- 2025年度房产代持及市场推广服务合同
- 2025测绘信息保密与知识产权保护合同范本含保密期限
- 2025年度教育机构贷款担保保证合同范本
- 2025年度企业员工培训与员工满意度提升咨询合同
- 第2课《开学的准备》(课件)心理健康二年级上册北师大版
- 公司入股投资合同范例
- 2025年秋新人教版数学一年级上册全册课件
- 电影鉴赏《头脑特工队》
- 《全新观光车操作与安全培训课件》
- 医疗器械使用安全责任免责书
- 进出口贸易合规管理制度
- 医疗器械冷链培训
- 公共政策分析 课件 第0章 导论;第1章绪论:政策科学的“研究纲领”
- 病理学课件下载
- 2024-2030年撰写:中国病房行业发展趋势及竞争调研分析报告
评论
0/150
提交评论