学生成绩综合评价模型_第1页
学生成绩综合评价模型_第2页
学生成绩综合评价模型_第3页
学生成绩综合评价模型_第4页
学生成绩综合评价模型_第5页
已阅读5页,还剩31页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

1、 学生学习状况评价与预测摘要随着社会办学规模的不断扩大,教学质量的保证和提高问题日益凸显,各种教学研究和教学实践层出不穷,但是学生学习状况的评价作为提高教学质量和激励学生努力学习的重要手段,却没有得到应有的重视,传统的评价方法忽略了学生基础条件的差异,并不能对学生的学习状况进行全面、客观、合理的评价,因而,建立一种科学的评价方法势在必行。本文首先通过分析附件中的612名学生四个学期综合成绩,发现成绩会根据试题的不同导致分布状态的变化,利用SK法,Q-Q图检验为负偏态分布。所以首先利用转化函数将所给的成绩进行标准化使得标准化后的成绩能够满足统一的正态分布曲线,去除了试卷难度对于学生的影响。然后在

2、对学生学习状况的评估中,建立了模糊综合评价模型、基于层次化分析的模糊评价的改进模型、数据包络分析法(DEA),这三个评价模型进行评价。基于层次化的模糊评价模型是模糊分类模型的改进,通过层次分析的方法能够得到可行科学的评估权值,利用标准化的成绩能够得到每个学生的评估总分,并不是模糊分类模型中量子化的得分。而DEA法主要注重的是成绩的稳定上升,是对于前两种模型的补充。在预测过程中我们运用了线性回归预测模型、模糊分析预测模型、GM(1,1)成绩预测模型、ARIMA(0,1,1)成绩预测模型,通过预测结果我们发现,在假设学生学习状况不变的情况下模糊分析预测模型的预测结果良好,可以很好的反映学生的动态的

3、进步情况,而GM(1,1)的预测结果很差,不推荐使用。如果考虑实际学生成绩波动和季节性变化的影响,则需要使用ARIMA(0,1,1),实际中这个模型的预测结果最好。预测成绩表学生序号12345678910第5学期第6学期最后,我们对我们所建立的模型进行了客观的比较,并对其应用前景进行了展望。关键字:标准化模糊综合评价模型层次分析DEA线性回归预测模型模糊分析预测模型GM(1,1)ARIMA(0,1,1)2问题的重述正确地、科学的评价学生的学习状况对于学校的教学工作至关重要,它是学生认识自己的前提条件,是激励学生努力学习不断进步的动力,同时也是教师培养学生的参照基础。然而,现行的评价方式单纯的根

4、据“绝对分数”评价学生的学习状况,忽略了基础条件的差异;只对基础条件较好的学生起到促进作用,对基础条件相对薄弱的学生很难起到鼓励作用。在本题中,附件给出了612名学生连续四个学期的综合成绩。要求我们做到以下三点:1根据附件数据,对这些学生的整体情况进行分析说明;2根据附件数据,采用两种及以上方法,全面、客观、合理的评价这些学生的学习状况;根据不同的评价方法,预测这些学生后两个学期的学习情况。2问题的分析1、首先我们通过原始数据可以做出其基本的统计量和直方图。考虑到在学生成绩评价中会收到试卷难度等因素的影响。所以必须得构造转化函数将所给的成绩进行标准化使得标准化后的成绩能够满足统一的正态分布曲线

5、,去除了试卷难度对于学生的影响。2、在学生整体成绩评估中,我们可以分析学生成绩平均值和稳定度的关系、分析学生成绩段人数、分析学生整体进步度、分析基础成绩对于总成绩的影响。3、对于构造模型对学生学习状况进行合理有效的评估,我们可以利用模糊综合评价模型、层次化分析法、数据包络分析法OEA)这三个评价模型进行评价。4、对于成绩的预测,我们可以想到基本的几个预测模型:线性回归预测模型、模糊分析预测模型、GM(1,1)成绩预测模型、ARIMA(0,1,1)成绩预测模型,每个模型的着重点都不一样,这样对于从不同方面解决问题有着很大的帮助。3模型的假设1、假设每个学期的综合成绩的满分为100分2、假设每个同

6、学的学习能力基本不变3、假设附件数据中的两个零是由特殊情况所致4、假设每个学生处于相同的考试环境中5、假设附件中所给数据为学生真实考试成绩,不存在作弊问题的影响6、以后两个学期与前面四个学期采用同样的记分方式7、在模糊预测模型中我们假设两个学期学生的学习状况是不变的4符号的说明j:学期i:学生序号D:总评价得分x0:第i个学生的第j学期的原始成绩。(/DMU.:第j个决策单元U:J因素集V:评语集i其他主要符号将在模型建立的时候详细说明。5模型的建立数据标准化为了避免现行评价方式中仅根据“绝对分数”评价学生学习状况,设计出一种新型的发展性目标分析法,必须考虑到户律基础条件的差异,学生原有的学习

7、基础,也注意到学生学习的进步因素。首先注意到题干中所给出的数据为学生四个学期的分数,由于在实际中,如果单单注意绝对分数的话,由于试卷的难度的不同,会导致单纯通过题干给出的数据信息进行分析肯定是不准确的。根据教育学与统计学的理论,一次难度适中信度可靠的考试,学生的成绩应接近正态分布。也就是说,当学生的成绩接近于正态分布时,说明此次考试基本达到了教学要求。判断成绩是否接近正态分布最直观,最有效的方法就是将成绩分布曲线与均值和方差相同的正态分布曲线加以比较。如果是负偏态分布,则说明试题总体难度偏高。如果是正偏态分布,则说明试题总体难度偏低。如果是陡峭型分布,则说明试卷中难度中等的度量占比重太大。I倡

8、态分丑这样首先做出所给数据中四个学期成绩的直方图和原始成绩的统计分析,其中实线表示正态分布的曲线,直观的说明所给成绩为偏正态分布。这样我们的目标就变为构造一种变换使学生每个学期的成绩符合相同的正态分布曲线,这样也就能将试卷难度等影响消去,才能对所给的每个学期的成绩相互之间进行比较。学主序号:To怡ISumNMeanStd.DeviationVarianceMedian手Bi氐绩44402.2361272.55279.5000790.25174.3165学期2成绩45516.B061274.373510.59740112.3057B.6359学期2成绩44780.2061273.17039.C1

9、324S1.23S74.1920学期4咸绩45938.5861275.063010.24230104.90576.5390其次对原始数据进行SK检验得:第一学期第二学期Sk第三学期第四学期&142Ku这样通过以上的分析,我们可以发现,直方图在标准正态分布曲线的右边,且SkvO,则都属于负偏态分布,说明试题的总体难度是偏低的。而且根据Ku值渐渐变大可以发现试题中中等难度的题目越来越多了。根据其平均值和方差可知:学生在第四学期的平均成绩最高,其次是第二学期,第一学期和第三学期的平均成绩略低一些;但是从方差来看,第一、三学期低于第二、四学期,这从上图中也可以明显看出,第一、三学期学生的成绩分布要比第

10、二四学期学生的成绩分布要集中。那么下面我们构造一种方法使得每个学期学生转化后的成绩符合相同的正态分布曲线。定义:x0(i=l,2n)为n个学生的某一学期的原始成绩。iy-ln(100-xo),这样就可以将一个偏正态分布转变成了y满足的正态分TOC o 1-5 h ziii布,由于该函数单调递减函数,原始成绩高的反而变得成绩低了,为和传统保证一致,进行以下变换X1=2y-y。这样就能得到一个满足标准正态分布的数据了。ii下面通过坐标的偏移拉伸使得其满足相同分布的正态分布。1l、X1-X1X1的方差为:b2=(X1-x1)2,得到X2=,这样均值就偏移in1i1bi=1到了x=0处,且标准差为1。

11、作出X2的直方图如下:E-10-.uu4J3b4JJLL.-4CO4JKI-JJB3闻-ICDODD1OJ20D3j7刑则E细_二_一-_0QQE3打651-xuutlnbLL-4do-2iDaaa20a学JtH加演flJM-2JCMODO2QDffl学刑3阪细利用Q-Q图检验其正态性得:说明其具有良好的正态性,那么数据的标准化和检验均告完成,这样就去除了试卷难度等客观因素导致成绩分布不合理产生的误差。下面就可以根据已得到的标准化数据对于学生成绩进行评估。学生整体状况的分析分析学生成绩平均值和稳定度的关系根据已经标准化的成立,利用平均成绩与方差所联合做成的散点图,我们可以看出,大体的情况是,多

12、数同学的成绩还是比较稳定的,就是个别同学,成绩起伏很大,并且大致趋势为,成绩越好的同学波动越小,相反,成绩不好的同学波动就很大。3.CO=.uqoh-4CB-7C0心tn-1jXiom1j3学生成绩段人数分析由于这里要进行学生成绩段的分析,就不能使用已经标准化的成绩了,显然如果使用标准化后的数据,则数据基本满足标准正态分布,这样进行成绩的分段研究也就失去了意义。对原始数据进行成绩的分段分析得:成绩人数学期123490分以上02108090分1382041291947080分2752463032876070分14011014410560分以下59503526通过以上分析我们了解到:第二学期和第四

13、学期80以上的学生要明显高于第一学期和第三学期,而70分以下的学生数量要低于第一学期和第三学期,这就使得第二、四学期学生的平均成绩要高于第一、三学期。而且不及格人数约来越少,成绩分布约来越集中,这正好和中SK分析得到的结果一致,也就是陡峭度越来越大。从饼状图中还可以看出,成绩的分布渐渐朝着高分发展,这与SK分析中Sk值渐渐减小也是相一致的。显然在这一步的分析中,造成这个结果的产生,可能因为试卷的原因,也可能是学生们通过学习进步的结果。学生整体进步度分析首先对标准后数据进行差分处理,计算出差分后的平均值,即平均进步率。作出其平均分数和平均进步率的散点图,如下:O.CO-1co-4.au3.DQ-

14、1.000OT1.QD300由图可见,在平均值为0处,即成绩中等的同学中,会出现进步和退步较快的同学,而在成绩较好的同学部分,成绩进步不大,在成绩较差的部分,退步的同学相比进步的同学较多。基础成绩对于总成绩的影响分析将第一学期的成绩看作是学生的基础成绩,作出基础成绩和总成绩的散点图:T-3.Q0-Z.OD-1.QQ-o.ac-1JJQ-3JJQ-IIIIIII屯ttnwmcooooiMJDOOQOQOWHQ3OKKKKK(nimWOm)辽mnWHWOD1MMKKK)OOOOM我们可以看出数据点大致看来成线性,所以,入学基础对大学读书影响还是比较大的。百度文库-让每个人平等地提升自我百度文库-让

15、每个人平等地提升自我 ii评价学生的学习状况模糊分类综合评价模型根据中我们发现评定学生学习状况的依据有,学生的平均分,学习波动度,进步度。下面从三个方面对学生进行综合评定。设:第i个同学的因素集U=平均分u,学习波动度(标准差)u,平均ii1i2进步率u,评语集V=优卩,良v,中v,差vi3ii1i2i3i4对于每名学生基于其四个学期成绩及成绩变化做单因素评价:首先我们确定优良中差的比例固定为1:4:4:1,这样就能使学生评价处于平均,增强学生的学习动力。1、对于平均分uii因为不同基础的同学对某一得分同学的评价不同,所以当一名学生得60分时,得分大于80分的同学会认为其基础差。所以对学生的分

16、数进行优良中差的比例分类:评者被评者良优优优0中良优优0差中良优差差中良得到u的单因素评价向量为:iir(rr,r,r),rr,r,r分别为优良中差的权重iiiiy,ill订ziiciiy,ill订ziic2、对于标准差u得:i2、评者被评者0良优优优中良优优差中良优差差中良得到U的单因素评价向量为:i2r=(rr,r,r),rr,r,r分别为优良中差的权重i2i2y,i2li2zi2ci2y,i21i2zi2cr=(rr,r,r),rr,r,r分别为优良中差的权重i3i3y,i31i3zi3ci3y,i31i3zi3crr)(、rr,r,ri1订y,ill订z订cR=r=rr,r,rii2i

17、2y,i21i2zi2cl:J、rr,r,r丿i3y,i31i3zi3c丿这样得到单因素评价矩阵:考虑到对于差生的鼓励作用,我们认为平均进步率和平均成绩甚至比平均成绩更加重要,这样我们将三个因素分配权重为:C=(,)B二CRii做模糊变换:二(04丄05)i1y,i1l订z订c“r,r,ri2y,i21i2zi2c“r,r,ri3y,i引i3zi3c丿二(b,b,b,b)iyilizic这样就能得到特定同学的评价向量了。在对其总分进行加权分析得:学生总评价分D二3*b+2*b+biiyiliz由于总评价分是在区间0,3上的,所以可以划分为4类:9/4,3,3/2,9/4,3/4,3/2,0,3

18、/4分别为优良中差。下面计算前10名同学的评价向量和总评价分:数据为:第一字期第二学期第三学期第四字期平均值極准差平均进步度1.65246-.14519-.01969.04971.13432.35471-.200912.19651-.29375.89342-.20989.14657.54198-.135473-1.15220-1.45022-.67912-.83416-1.02893.34302.1060141.25425.94948.27313.59153.76710.42639-.220915.25672.93537.42435.98828.6511S.36581.243866.54862

19、-1.01356.20926-.47184-.18188.69818-.340157.28566-.07246-1.16356-1.04802-.49960.71663-.444568-1.24526-1.51459-177200-372172-2.063401.12627-.025489-.52419.02465-.40460-.34685-.31275.23676.0591110.14055-.66180.11531-70687-.27820.46944-.262470.5,0.4,0.1,0可以得到第一名学生的叫=0.5,0.4,0.1,00.1,0.4,0.4,0.1丿这样B=(,)D

20、=所以第一名学生的评价应该为良11利用Matlab通过以上方法对所有数据进行求解得:(仅列出前10名同学的数据)学生序号biybilbizbicDi评价10.30.40.250.051.9520.260.40.2S0.061.86艮30.340.40.220.042.04良40.260.40.230.061.86艮50.50.40.102.4优60.050.250.40.31.05良70.050.250.40.31.05良800.10.40.50.6差90.340.40.220.042.04良100.10.40.40.11.5良学号前十的学生的综合评价排名为:DD,DDD,DDDDD53912

21、410678我们可以发现,由于构造加权系数的时候,我们在学生的优良中差的比例设置中将良和中的比例设置的比较高,这样导致了我们得出的分类评价中良和中比例比较高。这样也符合教师评价学生的一般规律。基于层次化分析的模糊评价的改进模型在5.3.1中我们发现上述的模型建立会出现如下问题:1、在5.3.1中,对于数据的结果我们发现,虽然我们求出了学生总评价分D,但是D是一个类似量子化得值,这是由于我们在模型建立的第一ii步就已经将各种成绩的数据进行了分类。这样由于D的值的影响,我们i会发现很多通过已给的成绩可以比较相互之间差异的同学,我们通过Di的值发现两者的学习状况是一样的,这显然是有问题的。那么我们可

22、以很容易的想到直接利用所得到的标准化的成绩进行分析。2、在5.3.1中我们了解到所给的权值都是我们自己预设的,这样的科学根据显然是不精确的,这样我们想到了利用层次分析法对权值进行估计。3、在5.3.1中,我们对于每个学期成绩的影响视为完全相同的,这显然是不精确的,在实际问题中,对于当前学生学习成绩的评估,最近一次的成绩当然是更加重要的。这样我们可以得到分析所用的层次图:首先对数据进行处理,由于评分的原因,不论是哪一学期的成绩还是进步度,抑或标准差,他们的单位首先是要统一的,我们将每组数据都除以改组数据的最大值,这样就能将他们的数据的满分设为1,这样总体评价分的满分也设置为1了。得到处理后的数据

23、为:顷猿1顷颈2成議3顷渍4顷渍迸歩亟茨迅步顷颈迅步舔准走123.24-.05-.01.02.0G.05.02.18.07-.11.27-.0S.14.43-.37.28-42-.55-.21-.38.06.28-.05一仃.46.37.OS.25.00-.2511.22.09.36.13.42.05-.19.19.19.20-.39.06-.20.23.44-.23.35.10-.03-.36-.44.24-.40.04.3E-.46-.58-.55-1.SG.59-.09-.66.57-.19.01-.12-.1.03-.16.02.12.05-.25.04-.30.10.28-.28.2

24、4.55.33-.35.51.09-.66-.39-.28-.1S-.37.02.04-.10.10下面根据层次分析法进行权值分析:设第i名学生的j个学期的成绩为mij,第k次成绩进步度为*,标准差为uIJik首先是第一层:同样是为了鼓励学生,我们设学生进步情况比学生成绩情况稍强,设为2;学生成绩情况比成绩波动性明强,设为5,学生进步情况比成绩波动性设为6;这样仃,1/2,5可得到比例矩阵为;Ri=2丄6(1/5,1/6,1丿这样通过matlab可得最大特征根入max=得到第一层权值向量为Wl=()通过检验得:CR二CI/RI=检验正确可行其次对第二层进行分析:设每学期对于学生总体成绩评价的影

25、响度逐步提升,得到:1,1/2,1/3,1/4、2,1,1/2,1/3R二23,2,1,1/2(4,3,2,1丿同样可得:最大特征根入max=得到第二层成绩权值向量为W2=()检验可行性成立同样成绩进步度对于成绩进步情况的影响逐步提升,得到:1,1/2,1/3、R二2,1,1/23(3,2,1丿同样可得:最大特征根入max=得到第二层成绩权值向量为W3=()检验可行性成立综上所述:准则层成绩进步程度基础单排序子准则层成绩1成绩2成绩3成绩4进步1进步2进步3单排序设612位同学的成绩向量,进步向量,波动性向量分别为:M=(m,m,m,m),S=(s,s,s),U1234123D=(M*Wt,S

26、*Wt,U)*Wti总成绩评价为:23得到评价如下表,通5.3.1的流量中差比例为1:总体评价4:4:学号总体评分类学号分类1进行分类得到:学号总体评分类12345678910良中中良良中中差中中12345678901X1X1X1X1X1X1X1X1X0中中良中中良中中中中12345678902222222223中良中中中差中差中中得到学号前十的同学的排名为:DDDDDDDDDD54162910378并发现学号为539的学生学习情况最好,调出其原始数据:学生序号学期1成绩学期2成绩学期3成绩学期4成绩539可以发现其平均成绩较好,而且在第四学期成绩有了很好的提升,这使得其在综合评价的过程中,由

27、于第四学期的成绩和进步的权重较高,这样该生的学习状况非常好。与5.3.1中的模型结果加以比较,可以发现:两者的分类情况基本是一致的,对比前10名同学的情况,发现2,3,6,7,9,10的同学,在评价时其分类由良变成了中,这是由于其第四学期的成绩不理想造成的,而在这个动态评价模型中,第四学期的权重是相当高的,这样才导致了这些同学的综合评价的下降。DEA方法评价模型DEA评价模型是数据包络分析方法,它的功能是“评价”特别是进行多个同类样本的“相对优劣性”的评价,它根据一组关于多输入多输出的观察值来评估有效性。DEA评价方法的原理:设有n个同类决策单元,每个决策单元都有m种类型的输入(表示对资源的耗

28、费)以及s种类型的输出(表示消耗了“资源”之后表明成效的信息量)。其中第j个决策单元DMU的投入向量为X=(x,x,,x)t,产出向量jj1j2jmjY=(y,y,,y)t,(X,Y)为DMU的生产活动。X为DMU对第i种类型输j1j2jmjjjjijj入的投入总量,x0;y为DMU对第r种类型输出的产出总量,ijrjy0。i=1,2,,m;r=1,2,,s。rj本文采用DEA的线性规则形式、对决策单元的规模有效性和技术有效性同时评价的DEA模型。基于输入的DEA方法C2R模型。对(X,Y)决策单元DMU的C2R模型可以表示为:000min=0-s(eTs-+eTs+)12s.tYX九+s-=

29、6Xjj0jY九-s+=Yjj0j=1九0(j=1,2,n),s-0,s+0j其中eJet分别为元素均为1的m维向量和s维向量,表示阿基米德无穷12小量,s-=(s-,s-,,s-)T,s+=(s+,s+,,s+)T是松驰变量。12m12m设以上线性规划的最优解为加,s-*,s+*,6*,则有:若6*=1,s-*、s+*的分量存在非零值,则DMU为DEA有效(C2R)。表示0DMU的生产活动同时为技术有效和规模有效,各种资源得到充分利用;如果某0个s+*的分量大于0,则表示某种输出指标还有增大的可能。若6*=1,s-*=s+*=0则DMU为DEA有效(C2R)。表示DMU的生产活动00同时为技

30、术有效和规模有效,各种资源得到充分利用,取得了最大的输出效果。3)9*1,则DMU为DEA无效(C2R)。表示DMU的生产活动既不是技术有00效也不是规模有效,生产活动的输入规模过大,产出水平没有达到最佳规模。4)若丄工九*二1,则DMU的规模效益不变,表示生产规模最佳。TOC o 1-5 h z9*j0j=i5)若丄九*DMUDMUDMUDMUDMUDMUDMUDMU35692101487这样我们发现了一个问题,就是这种模型中效率的排序和上述模糊算法得到的结果有较大的差异。这是两个模型的着重点不同造成的。在模糊算法中,我们注重看重的是学生的进步,而在此模型中,我盟看重的是输入因子和输出因子的

31、符合情况,也就是说看重的是学生成绩上升的平稳度是否良好,如果一个学生其成绩能够按照模型的轨迹既定平稳的上升,则认为其学习状况良好,这是这两个模型的侧重点不同造成的结果上的差异,但实际运用中,教师可以选择不同的参考点,对学生进行多方位的评价。百度文库-让每个人平等地提升自我百度文库-让每个人平等地提升自我 2l成绩预测模型在成绩预测中,我们所要得到的是预测学生实际成绩,那么应该利用原始数据还是利用标准化之后的数据呢?由于在实际情况中,试卷会沿袭以往的情况出现负偏态分布,这样我们可以通过利用标准化的数据得到预测结果,再将成绩转化成负偏态分布。但是显然通过标准化和逆标准化转化是繁琐的没有必要的。所以

32、我们采用原始数据进行预测,这样既减小了两次转化所带来的误差,也考虑到了试卷难度变化的影响,而且减少了计算的繁杂性。(1)线性回归预测模型通过speaman等级相关系数显著性检验分析得到下表,相关系数均大于,说明不同学期之间的成绩具有高相关度。表明可以进行线性回归预测。Correlations学期诚绩学咧绩学期3成绩学昨绩SpearmanBrho早国1戒渍CorrelaticnDoefficien:1.000.773.748*.669*Sig.(2-tailed).0D0.000.000N612612612612学期即戈喷CorrelaticnDoefficien:.773*-.0D0730*7

33、12*Sia.(2-tailed).000.000000N612612612612学期3成渍correlaticnooenicienl一720“1.000,775TASig.(2-tailed.000.000.000N612612612612学期碱渍correlaticnooenicienl.559TA.门2.7751oaoSig.(2-tailed.000.000.000N612612612612correiallonissignificantatme0.01level(2-talled).由x=ax+bx+ex+d可知,当j=4时,利用前三个学期的成绩线性jj_lij-2j_3加权求得第四

34、个学期成绩的预测值,通过最小二乘拟合求解系数a,b,c,d。如下图:Co&fficients3ModelUnstandardizedCoefTicientsStandardizstiCoefficientstSigBStd.ErrorBeta1Gontant学期1成绩7.1192.1883.253.001.023.04&.021.499.61B学期2成绩.207.029.214&珂.000学期3成绩.696042.61316.476.000a.DependeniVariable:期4成绩得到方程为:x=0.696x+0.207x+0.023x+7.119jj-1j-2j-3通过此方程对于学生第

35、5,6学期的成绩进行预测得到:学生序号123456789学期179学期2学期3学期4学期5学期6作出预测结果的直方图:guu0lrib4l.IJIM-Ltea*7G17S勺止改牛-asiBgiN-S12AZHJan*巴丄3J.WOOD0).00BDCO20JXIra_J1LI4DJD06O.K80.00hnn-773d.=3dlaN-012从以上图表可以发现:1、观察预测的第五学期和第六学期的数据可以发现,成绩总是向上增长的,这是线性回归模型所决定的,但是实际上并不是这种情况。在实际中我们发现,学生第二,第四学期的成绩较高,也就是说学生的成绩应该是波动的,这是这个模型中所存在的问题。2、观察直

36、方图我们发现,其满足负偏态分布,而且和前四个学期的分布曲线相似,这也是由于模型本身所决定的,在这个模型中由于各项成绩线性变化,显然分布曲线相似。在这一点上模型的符合是良好的。2)模糊分析预测模型基于5.3.2中层次化模糊评价模型,如果我们假设学生的学习状况能够保持一致不变,这样如果学习状况良好的同学显然在后面的学期中能够保持良好的增长态势,而学习状况不好的同学成绩会有回落的发生。利用原始数据做出学生学习状况的评价表:还是利用公式D=(M*w2t,S*WT,U)*W1T,这里考虑到标准差这个因素的影响较小可以忽略,将原式简化为:D=(u,u,u,u*Wt,u一u,u一u,u一u*Wt)*WtTO

37、C o 1-5 h zj_3j-2j-1j2j-2j-3j-1j-2jj-131u=0.0446u+0.0183u+0.1059u+1.9646Djj-1j一2j-3,其中W1=()但这里面的M,S向量均用原始数据代替得:总体评学生序总体评学生序总体评学生序总体评学生序号价号价号价号价11121312122232313233341424345152535616263671727378182838919293910203040现在总体评价向量D已知,我们利用D对第五,第六学期的成绩进行预测:假设第i个学生第j学期的成绩为u,第j学期的成绩向量为u,得:ijjD=(u,u,u,u*WT,u-u,u

38、-u,u-u*Wt)*Wtj-3j-2j-1j2j-2j-3j-1j-2jj-131求解上述方程可得:u=0.0446u+0.0183u+0.1059u+1.9646Djj-1j-2j-3j-1从而可得第五,第六学期预测值为:学生序号12345678910学期1成绩学期2成绩学期3成绩学期4成绩学期5成绩学期6成绩79做出预测后成绩的浮动图:学生成绩浮动圈学期从浮动图中我们发现:学生成绩浮动基本与上一学期的增长斜率相吻合,这很好的满足了该模型求解的原理。从浮动图中我们看到了第八名学生的成绩浮动比较不同,观察原始数据我们看到,第8名学生的成绩第四学期为,由于本模型是根据前一学期的学习状况不变为首

39、要条件求解的,在图上的反映为,第五第六学习该生的成绩仍然是下降的。再观察其他学生我们发现其预测成绩的波动基本沿着前一学期的学习状况进行的,这样也很好的符合了该模型的求解。但是我们发现最终的式子中,前三学期的成绩所占用的权值是十分小的,且浮动图中得到的预测成绩虽然有浮动,但是浮动也比较小,这样我们想到了灰色预测模型,GM(1,1)模型。(3)GM(1,1)成绩预测模型设学生前n学期的数据向量为:x(0)=(x(0)(l),x(0)(2),x(0)(n),作累加x(k)八x()(j),生成数列x(l)二(x(l)(l),x(l)(2),x(l)(n),微分方程j=1dx(1)(t)+bx(1)(t

40、)=bdt12是1阶1个变量的微分方程模型,记为GM(1,1).为了辨识模型参数b,b,在区间k1tk上,令12dx(t)dtx(t)=z(k)=(x(0)(k1)+x(0)(k),二d(k)=x(k)x(1)(k1)=x(o)(k),则2上式化为离散模型:d(k)+bz(1)(k)=b12记b=(b,b2)T,D=(d(2),d(3),d(n)T,B=z(1)(2)z(1)(3),一般可用最小z(n)二乘法min(D-Bb)T(DBb)求出b的估计值b,可以证明,当BTB可逆时,有b=(BtB)-iBtD这样就得到了参数b,b,带入微分方程:12bbx1(k+1)=x0(1)2eak+2bb

41、11这样利用x0(k+1)=xi(k+1)X1(k)就能得到预测的结果了。利用matlab求解得到的预测结果和直方图如下:学生序号学期1成绩学期2成绩学期3成绩学期4成绩学期5成绩学期6成绩179273.359.68.483.76.583.665.775.858.976.1069.75.从数据中我们发现,虽然GM(1,1)模型是根据前4学期的成绩来进行的预测,但是预测结果是很不正确的,比如:成绩中等学生的预测较为准确,但是对于成绩较差的学生,由于是利用最小二乘法求解,在求解的过程中出现了奇异矩阵,对于进步很明显的同学,预测的分数则可能超过了100分。在由直方图可以看出,其直方图的分布情况也不能

42、满足前四个学期的负偏态分布,所以我们得到以下结论:对于GM(1,1)模型对于求解中等成绩学生的预测是准确的,但是对于有很大波动的学生,或者进步退步很快的学生的成绩预测会产生很大的误差,所以在这里不推荐使用GM(1,1)模型对学生成绩做以预测。上述两种模型都是根据前面的成绩对于后两学期进行预测,在本质上都考虑了学生的当前学习状况。但实际中我们发现,学生的学习状况是有波动的,正如原始数据揭示的那样,第1,3学期的成绩较差,第2,4学期的成绩较好,学生的成绩是根据季节性变化的,那么也就是说在此模型的假设中,假设根据前一学期学生的学习状况求后一学期的成绩并不是十分的准确,下面根据以上分析利用ARIMA

43、(0,1,1)模型进行求解。ARIMA(0,1,1)成绩预测模型AR模型:当序列中z和z有线性相关时,类似于y和x的线性相关,我TOC o 1-5 h ztt1们可以用线性回归方程表示z和z之间的关系:z=0z+utt1tt1t这样把z分成了两个部分:一部分由过去值z表示,另一部分独立于z的tt1t随机剩余项u表示,服从N(O,b2)。这样z建立了和自己过去的线性回归,称为tt自回归模型。如果为p阶自回归模型:z=0z+.+0z+u,记为:(B)z=ut1t1pt一ptttMA模型:是移动平均模型。q阶MA模型,记为MA(q),观测值z被描述t为过去误差的线性回归:z=u0u.0u,记为z=9

44、(B)u。tt1t1qtqttARIMA模型,求和自回归-移动平均模型。记做(B)w=&(B)u,如果d阶ttq)。1,1)预测:差分,其中W为z的d阶差分,记做:ARIMA(p,d,tt利用SPSS中自带的ARIMA模型,做ARIMA(0,得到其数据:学生序号学期1792345678910学期273.59.83.83.65.75.58.76.69.学期368.76.75.学期4学期5学期6在做出其浮动图和直方图得:通过上图我们发现:1、在这个模型中,学生成绩的波动性得到了很好的体现,如波动图所示,成绩有着季节性的变化,观察第8名学生的成绩,我们发现,在第四学期,其成绩为,但是预测中我们发现其

45、成绩在第五学期并没有出现异常的情况,表明这个模型在一定程度上可以屏蔽原始数据奇异值的情况。2、通过直方图我们发现,在这个模型中很好的吻合了负偏态分布,而且和前四个学期的分布曲线相一致。6模型的比较与应用下面我们对所给出的模型进行比较:在评估过程中我们运用了如下几个模型:模糊分类综合评价模型首先利用已得到的标准化数据,求得所有学生的成绩平均值,学生的平均进步度,学生的波动度这三个影响学生学习状况的值。并对于这些数据进行优良中差的分类,接着人为的规定每个部分的权值,利用这个权值对于学生的学习状况进行模糊分类评估。优点:能够较精确的对学生的学习状况进行分类缺点:在权值的分配上是人为进行的,这是不科学的一种分配方法。得到的总评价分由于数据在一开始就已经进行了分类处理,所以所得到的总评价分是一个量子化的值,这样就不能精确的对两两学生的

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论