版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
1、SPSS方法简介自由度:自由度在数学中能够自由取值的变量个数,如有个变量、,但,因此其自由度等于。在统计学中,自由度指的是计算某一统计量时,取值不受限制的变量个数。通常n其中为样本含量,为被限制的条件数或变量个数,或计算某一统计量时用到其它独立统计量的个数。自由度通常用于抽样分布中。0.Spss的适用范围1)统计描述运用适宜的统计指标、统计表、统计图等方法,对研究对象(变量)的分布类型和数量特征进行展示的过程,通过统计描述可以研究对象的基本特征。2)概率分布随机变量:变异现象在生物界普遍存在,这种变异现象表现在人体某一具体指标或变量上,就是其数值的变化,测量前的不可预知性,这种变量叫随机变量频
2、数分布表和分布图描述了某一随机变量的经验分布,这是针对样本资料来透视数据的分布特征。由于抽样的随机性,样本的经验分布会随着样本的不同而变化。当样本扩展到总体时,随机变量的总体分布即为概率分布。变量值的常见总体分布有正态分布、二项分布和Poisson分布,常见的抽样分布有t分布、F分布和X2分布,本质上这两种分布都是概率分布。3)参数估计与假设检验统计推断是根据样本提供的信息,以一定的概率对总体的分布及其特征作推断,常包含参数估计和假设检验。参数估计是指由样本统计量估计总体参数;假设检验是指对所估计的总体的首先提出某种假设,然后根据随机样本信息及抽样误差理论,应用小概率反证法逻辑思维推断某种假设
3、可被接受或拒绝的统计检验方法。4)t检验T检验是以t分布为基础,是数值资料中常用的假设检验方法主要用于两个均数的比较。理论上,t检验的应用条件要求样本来自正态分布总体,随机样本且总体方差齐性。当样本含量(确切讲是自由度)较大时,t分布近似于正态分布,可用U检验(又称z检验),此情况下t检验等价于U检验。5)方差分析对于多个样本均数的比较,需用方差分析,多样本均数的比较不能反复使用t检验的原因是会增大I性错误的概率。6)双变量相关与回归分析变量之间的关系有确定性关系(函数关系)和非确定性关系(随机性关系)。确定性关系是指对于一个变量的每个可能取值,另外的变量都有完全确定的值与之对应;非确定性关系
4、是指变量间的关系不确定,如人的身高与体重、胰岛素与血糖、年龄与血压、吸烟与肺癌、体温与脉搏等,这些变量间关系密切,但不能由一个或几个变量的值精确求出另一个变量的值。回归与相关(regressionandcorrelation)是研究变量间非确定关系的统计方法。7)x2检验即卡方检验,是以x2分布为理论基础的统计方法,主要包含两个样本率或构成比、多个样本率或构成比之间的差别有无统计学意义及多重比较、两个分类变量之间的关联分析、频数分布拟合忧度的X2检验。8)基于秩次的非参数检验假设检验分为参数检验(parametrictest)和非参数检验。参数检验是以特定的总体分布(如正态分布)为前提,对未知
5、的总体参数(如u或n)进行推断的假设检验方法。但有时候总体分布不易判定,参数检验的条件得不到满足,在这种情况下,可以采用非参数检验的方法。非参数检验是参数检验方法的有效补充,它并不依赖于总体分布类型,不检验总体的参数,而是对总体的分布或分布位置进行检验。9)协方差分析方差分析要求各比较组除所施加的处理因素不同,其它对观察指标有影响的因素要求固定在同一个水平上。但有时是的处理因素对观察指标产生了影响,在直接分析观察指标建的差异则不满足方差分析对处理因素的要求。比如降糖药物临床疗效研究中,试验后的血糖值是评价药物疗效的一个重要指标,但试验后的血糖值受试验前血糖值影响,实验前后的血糖值间存在一定的线
6、性关系,试验前的血糖值是难以控制,如果直接分析试验后的血糖值间的差异来评价药物的降糖疗效不恰当,这里必须扣除或均衡不可控制因素(试验前的血糖值的影响),故考虑应用协方差分析。10)多重线性回归分析一个应变量与多个自变量之间依存关系的统计方法。多重线性回归分析要求应变量是服从正态分布的连续性数值变量。11)Logistic回归分析应变量是分类变量(包括二分类和多分类)的资料,如治愈与未治愈,生存与死亡,发病与未病,疗效评价分显效、好转、无效等。这类资料,由于应变量是分类变量不具有连续性和正态性,直接用一般多重线性回归分析是不妥的,可用logistic回归分析。适用于应变量为分类变量的回归分析。1
7、2)生存分析应用于社会科学和自然科学领域具有不完全数据的事件分析,如设备的失效、疾病的发生、患者康复或复发等,另外还有可靠性分析和失效时间分析。13)聚类分析和判别分析都是研究事物分类的统计学方法。聚类分析是在事物分类面貌尚不清查,甚至连总共分几类也不确定的情况讨论事物的分类问题,是“无法可循”的方法;判别分析是根据已知其类别的样品,总结出类别的判别方法,用以判断未知类别的新样品的类别,是“有法可依”的方法。14)主成分与因子分析旨在浓缩数据或简化数据,即以最少的信息丢失为代价将众多的观测变量浓缩为少数几个因素,从而提炼问题,或发现事物的内在联系。主成分分析和因子分析是最为常用的数据简化方法,
8、用于考察多个变量的内在结构,或者提取数据的主要信息。15)Meta分析对已有研究结果进行二次定量综合分析与评价,是现代循证医学产生最佳证据的重要方法。1.Spss软件中常见的累积概率分布函数和密度函数函数形式函数说明累积分布函数返回标准正态分布的累计概率值返回任意给定的正态分布的累计概率值返回任意给定的二项分布的累计概率值返回任意给定的分布的累计概率值返回任意给定自由度的分布的累计概率值返回任意给定自由度的分布的累计概率值返回任意给定自由度的分布的累计概率值返回任意给定参数的均匀分布的累计概率值概率密度函数()返回任意给定的正态分布的概率密度值返回任意给定的二项分布的概率密度值返回任意给定的分
9、布的概率密度值返回任意给定自由度的分布的概率密度值返回任意给定自由度的分布的概率密度值返回任意给定自由度的分布的概率密度值2.累计函数和密度函数transform-computevariable-写目标变量的名字,然后找合适的函数,填入适当参数即可。求可信区间输入变量值-analyze-descriptivestatistics-explore-选择求值变量-dipendent-statistics-descriptive-continue-ok1)求T界值(T分布函数的逆函数)T分布函数(跟累计函数和密度函数路径一致)CDF.T(q,a)=p(0v=pv=l,a0,a为自由度)其逆函数IDF
10、.T(p,a),将会返回q值。比如求双侧检验自由度为8的t界值t005/28,赋值为t=IDF.T(0.975,8),得tQQ5/28=2.30600,假定求单侧检验t界值t0058;则赋值为t=IDF.T(0.95,8),得t0058=1.8595582)正态性检验(分布检验,不适合样本太小时)Analyze-descriptivestatistics-explore-(需检测正态性的变量)-dependent-plots-stem-and-leaf,histogram,normalityplotswithtests-continue-ok可以得出:基本统计描述指标、偏度系数和峰度系数及其标
11、准误、Kolomogorov-Smirnov(即D法)与Shapiro-Wilk(即W法)的检验统计量与对应的P值、Q-Q图与去势的正态Q-Q图、箱图等。另外,还可以由anaylyze-descriptivestatistics-P-PPlots或Q-Qplots或Q-Qplots视窗中,选中normal正态性检验,作P-P图与去势的正态P-P图或Q-Q图与去势的Q-Q图,点击testdistribution下面选框中的下拉键头,选其他分布,可进行对应的分布检验,如选studentt,则进行t分布检验。t检验(Ttest)单样本t检验Analyze-comparemeans-one-sampl
12、eTtest-”检查变量”-右下test框中修改系统默认值为比较的值配对设计t检验-比如治疗前后比较paired-sampleTtest过程进行配对设计t检验:analyze-comparemeans-paired-sampletest-”选择配对的两个变量”-pairedvairables-ok独立样本t检测-比如两组治疗情况对比analyze-comparemeans-independent-samplesTtest-”分别把检测变量和组别选好”-continue-ok例如:急性黄疸性肝炎患者退黄天数组别人数退黄疸天数中药组7510142117812对照组81821302322222920
13、结果:GroupStatistics鉀1NMeanStd.DeviationStd.ErrorMean退萤天數1712.435.4422.0572823.124.2241.493LevenesTestforEqualityofcomputevariable-targetvariable中输入“比较变量的对数”,选中“比较变量”-numericexpression-ok频数加权:data-weightcase-weightcaseby变量2-frequency-ok正态性检验:analyze-descriptivestatistics-exlpore-比较变量-dependent-组另-fact
14、orlist-plot-stem-and-leaf、histogram、normalityplotswithtests-continue-ok对数数值的t检验:analyze-comparemeans-independent-samplettest-“检测变量”-test-组另另-grouping-definegroups-continue-ok单因素方差分析Analyze-comparemeans-one-wayANOVA-”检测变量”放入dependentlist,”组别”-factor-options-descriptive、homogeneityofvariance-continue,
15、返回one-wayANOVA-postHoc-LSD、S-N-K-dunnett,在controlgategory-first-continue-OK双(多)因素方差分析Analyze-generallinearmodel-univariate-检测变量放入dependent,“组别”“区组”放入fixedfactor-mode-custom将“组别”“区组”-右model框-continue-PostHoc,将factor内的“组别”-posthoctestsfor-LSD、S-N-K、Dunnett,在controlcategory-first-continue-options-ddesc
16、riptivestatistics-continue-ok多因素Analyze-generallinearmodel-univariate-选择自变量和因变量-option-displaymeansfor-选中descriptivestatisticsSPSS软件分析没有给出交互作用项各种搭配的均数或合计,所以,在方差分析的基础上,找最佳搭配,非交互作用因素不同水平差别有统计意义,可采用SPSS输出的相应因素不同水平的均数大小,结合专业,来决定取哪个水平。但有交互作用的因素选哪一个水平,还需要手工计算。6相关分析(H0701-03)直线:散点图:graphs-legacydialogs-sca
17、tter/dot-simplescatter-define-x,y车由选好-ok正态性检测线性相关:analyze-correlate-bivariate(双变量相关分析)-变量放入variable框-correlationcoefficients-pearson,在testofsignificanee下选中two-tailed-ok秩:Analyze-correlate-bivariate,”自变量”因变量”-variables,在correlationcoefficients-spearman,在testofsignificanee下选中two-tailed-ok回归分析:散点图:grap
18、hs-legacydialogs-scatter/dot-simplescatter-define-x,y车由选好-ok正态性检测线性回归:analyze-regression-linear,”待检测变量”-dependent”因素变量”-independent-statistics,选中estimates,confidenceinteraval,modelfit-continue-save,在predictedvalues-unstandardized,在predictioninterval-mean血召总胆固棘PREJZRE_1LMCIJUMCI|JCI_1”来PF异2ZRE_2LMCI_
19、156S11212.60327H143?11.034301355156平方血糖的|工(总1.-1143?123.799.7449E-0.90D50a.-sssoa10.88S7O7.1100112.378719.744.3G-0.90050360212313.2119GO.B696012.2H651421206Id方和17.2&6I3.2H360S69501J4.E6111.611.392S4D.1B77310.6643312.120948.911D213.B742G11.392640.1977315400IQ410070910.3136190565111103317433S612.B5S16
20、10.0TO103138166.D514.313.25E61D.9930312.2434012738110.B7S1715.B3EO413.258610.9S90317490111十鲜曲-0.3531610741219282899048139602911.4TO0-0.353131H7.D815.114.0KE3D.228S313.237641IE.4S2S211986D717.7343914.660230.220631g39596983766-0226&2672549109J983?2H76B12457769.03766-0226E2104.6511211.081642.01W10.3135
21、11IL84977858SD413.5752411.081642.019971114531101000VI0M3571131?S43M?13467WI096SMOOnrji直线回归的方差分析F=24.233,P=0.001直线回归方程的截距a=3.851,回归系数b=1.555,t检验t=4.923,p=0.001PRE_1为预测值,ZRE_1为标准化残差,LMCI_1和UMCI_1为反应变量总体均数95%的可信区间下限和上限值,LICI_1与UICI_1为反应变量个体值95%的容许区间下限和上限值。本例中只有第10个标准化残差大于2,x=5.5对应的血糖预测值为12.40337,总体血糖的9
22、5%可信区间为(11.56355,13.12635),个体血糖95%的容许区间为(9.83202,14.85788)7非线性回归分析+非线性回归方程(Ii0704)八“z乃一跆六ModelSumofSquaresdfMeanSquareFSiq.1RegressionResidualTotal209.4731.646211.1191)7窗口产生.2T4新:变量.000=ANOVAPredictors:(Constant),InXDependentVariable:Yform-compute入新变量x)-ok,可在alyze-归方程成立;j+7.777ln(X)Coefficients3Unst
23、andardizedCoefficientsStd.ErrorStandardizedBetaSig.例如12垢则1Coiinfl52F&EjqpededCaufil353222Bases%wHhln彳目別11DD.O%orTclailn.1%1艸mas2CurflflF4X13SO81ic.D%wr|h|niB別ob.Det%ofTolsi19J%.6.9%26.6%TWlCoWI咖31果EmeclBdCoufil345D31D37B.0%kVHhln姐別91J%如果果%arTolail91B%0.2%1DD.O%Jllodel1.000组成X22)As-yntpSicEkHClQra(2-
24、g.idei3EKitlSIg(1-dem-0MMdjvmp縮L:f.:r:adW.cig(1-OT&*iWlirnLilailMbdIRW111(中FdlNrEjUKIT世MlLNwv-rijnirchiton10ill1CN*耐1T#5f*031*”科祁卄叩科号怜”斗结果:p独立伸性BWMoavhfft)f2UMaaoVIU4检验法总体TiiririiiQNkn瀚BrrtdMwiiriMglVMCtMFib;iHI率Mlt伽辭urgingwnuM河tNKUAOhiilMr血Iihfri血i*data-weighte-descriptive组别一rows,疗效亍)-continue-cell
25、s,选中total-continue-ok数均5(tl2=22.8,t22=8.2,continuitycorrection),总例E正的x2检验,pearsonsher确切概率法)冃数为变量名,频数加权case),analyze-descriptive乙法一column-statistics;选ycoefficient、kappa、rved、expected、row、列联系kappaix2=11.096,v=1,p=0.001;t):r=0.395,P=0.001;p0031。结论:关联性分析认为甲呈度中等;优势性检验0.05,按f异有统计学意义,结合本例bc,甲法检查的阳性率高于乙法。Li
26、near-by-linerassocilation线性趋势检验,spearmancorrelationspearman等级相关系数3)构成比拟和优度检验数据以“中医证型”、“例数”,频数加权,analyze-nonparametrictests-chi-squera,中医证型”-testvariable-ok4)二项分布拟合优度检验(有问题)数据以“每户发病人数”、“实际户数”,频数加权,analyze-descriptivestatistics-每户发病数一variable-option,选中mean、sum-continue-ok;transform-computevariable-输入P
27、1,公式PDF.BINOM(每户发病数,3,120,260)同样实现:作为理论户数变量T,赋值为260*P1;作为计算卡方统计量的过程变量X,赋值为x=(实际户数-T)*2/T;作为计算卡放统计量的变量xx=485.68+30.45+52.40+9.47;作为卡方检验的变量P=1-CDF.CHISQ(XX,2),这里自由度v=2.5)CMH统计分析数据以中心、组别、疗效、频数为变量名,频数加权,analyze-decrisptivestatistics-crosstabs-组别rows,疗效column,中心layer1-statistics-选中chi-square+cochransandm
28、antel-haenselcontinue-cells-observed,expected,row,total-continue-ok要跑Frequenciesanalysis,从SPSS菜单选:Analyze,DescriptiveStatisticsFrequencies.选好一个或几个分析变量.点击Charts.选一个图象类型例如Piecharts,Bar,Histogram,点击Continue.点击OKintheFrequenciesdialogbox.注意这个程序不但可以用于分类变量也可以是连续变量.但你此时要把频率表去掉不选.办法是和前面一样进入该程序菜单内,选择一个连续变量(例
29、如销售额或广告数目)作分析变量,再把Displayfrequencytables前面的选项去掉变成空白即可.接下来的警告不要管它点击OK就可以.点击Statistics,选Quartiles,Std.deviation,Minimum,Maximum,Mean,Median,Skewness,andKurtosis.点击Continue点击ChartsintheFrequenciesdialogbox.选Histograms,选Withnormalcurve.点击Continue.点击OKintheFrequenciesdialogbox.要跑Crosstabsanalysis,从菜单上选An
30、alyze,DescriptiveStatistics,Crosstabs.选好行变量和列变量.如果要看三个变量关系可以加一个Layer变量,点击Statistics,再根据你的变量性质选不同统计值.一般来说不论变量测量尺度如何都要选Chi-square.接下来如果是定类变量还可以选ContingencyCoefficient,PhiandCramersV,Lambda,andUncertaintycoefficient.如果是定序变量要选Gamma和SomersD.如果是定类和定比就可以选Eta.如果是两个虚拟变量可以选CochransandMantel-Haenszel统计值.也可以选Ri
31、sk统计值.然后点击Continue.点击OKintheCrosstabsdialogbox.要跑平均数比较从菜单上选Analyze,CompareMeans,Means.选因变量和自变量.如果要检验线性,非线性以及综合效应可以选AnovatableandetaandTestforlinearity.点击Continue.点击OKintheMeansdialogbox.要作单样本t测验,从菜单中选Analyze,CompareMeans,One-SampleTTest.选一个分析变量(必须是连续变量),输入一个假设值或需要检验的值,例如每月平均购物消费额是200元,每月平均生活费是500元等,
32、点击Options,再输入一个置信水平例如90%or99%(95%是缺省值),点击Continue.点击OKintheOne-SampleTTestdialogbox.要跑独立样本T检验,从菜单选Analyze,CompareMeans,Independent.选分析变量(必须是连续变量)和分组变量,点击DefineGroups,根据分组变量选0和1为分组变量值(注意只能有两个值,更多组数就要用方差分析了.点击Continue,点击OKintheIndependent-SamplesTTestdialogbox.要跑成对样本t检验,从菜单选Analyze,CompareMeans,Paired
33、-SamplesTTest.选两个成对变量,也可以选多对变量比较.点击OK要跑线性回归,从菜单选Analyze,Regression,Linear.选因变量,自变量,也可以选一个变量去标记样本中的个体例如学号等,再选Plots,选*SDRESID作y变量,*ZPRED作x变量,再选Histogram以及Normalprobabilityplot.点击Continue.点击SaveintheLinearRegressiondialogbox.选StandardizedinthePredictedValuesgroup.选StandardizedintheResidualsgroup.再选Cook
34、s和LeveragevaluesintheDistancesgroup.点击Continue.点击OKintheLinearRegressiondialogbox.要跑聚类分析对变量进行归类,从菜单选Analyze,Classify,HierarchicalCluster.选一组变量作分析变量,选Mode1作为thecaselabelingvariable,选变量作Cluster,点击Plots.选Dendrogram,选NoneintheIciclegroup.点击Continue.点击MethodintheHierarchicalClusterAnalysisdialogbox.此时可以试验不同聚类方法如Nearestneighbor,Furthestneighbor,Centroid,Wa
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 2027年购粪合同二篇
- 2027年淘宝详情设计合同二篇
- 合规转利润:降本增效全指南(2026)《GBT 35909-2018猪肺炎支原体PCR检测方法》
- 养蜂员岗前复试考核试卷含答案
- 浆纱机操作工安全宣传知识考核试卷含答案
- 矿井泵工岗前跨领域知识考核试卷含答案
- 细菌性疫苗生产工班组考核考核试卷含答案
- 塑料制品生产检验工标准化强化考核试卷含答案
- 软体家具制作工岗前安全生产意识考核试卷含答案
- 数控研磨工常识测试考核试卷含答案
- 2026年烟花爆竹零售经营安全考试试题及答案
- 2026年人教版新版数学四年级上册第三单元《多位数乘两位数》教学设计
- 新苏教版科学六年级上册1.1 《蜡烛的变化》教学课件
- 新教科版科学五年级上册1-1《研究放大镜》教学课件
- 工程测量安全培训课件
- 2024年湖南省公民信息管理局招聘笔试冲刺题含答案解析
- pk摇粒绒的工艺
- 缺血性心肌病护理查房课件
- 智能家居设备安装与调试高职全套教学课件
- 工资条(标准模版)
- 检具设计的基本要求
评论
0/150
提交评论