基于Web的自适应历年考试系统_第1页
基于Web的自适应历年考试系统_第2页
基于Web的自适应历年考试系统_第3页
基于Web的自适应历年考试系统_第4页
基于Web的自适应历年考试系统_第5页
已阅读5页,还剩1页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

基于 的自适应测试系统:数模式::数模式::数模式::数模式::数模式::数模式:受测者能力值以目的区分度以目的难度以目的猜测系数背景简介着社会的进步和商品经济的不断发展,社会对劳动者和技术人员的知识和能力水平的要求越来越高。测试作为衡量人的能力的重要手段,代生活中的地位进一步提高,并深入到社会的各个方面。各种各样的学历测试、资格证书测试层出不穷。同时,随着科学技术的不断发展式的手段和媒介也在发生着革命性的变化。从传统的纸笔测试到计算机辅助测试,到最新的基于的测试。如何运用高新技术,并客观布地评估人的知识和能力水平,已成为研究的热点问题。测试理论的发展,测试的指导理论主要有两种:〕以真分数理论为代表的经典测试理论 C,2项目反应理论 )T经过了近百年的发展,经典建立了一系列题目分析的公式,如表示难度的值,表示区分度的题目与测试相关系数,估计分数真值的标准误差及由此推算出来的信;。经典测试理论对建立试卷、考分转换与等值等均有一套较为完整的方法。但此理论仍有不够完善的地方:考生分数和题目难度有着密即题目难度是相对于考生而言的。如何使得题目参数稳定,不受受测样本影响,项目反应理论正是在这种背景下出现的。反应理论是以受测者的回答问题的情况,经题目特征函数的运算,推测受测者的能力。根据参数的不同,特征函数可分为单参数、双参:数三种模式,公式如下:)))特征函数可画出题目的特征曲线,图一为典型的三参数模式的特征曲线:图一一中可以看出参数,题目的区分度,即特征曲线的斜率,它的值越大说明题目对受测者的区分程度越高。参数,题目的难度,即特征曲线在横坐标上的投影。参数,题目的猜测系数,即特征曲线的截距。他的值越大,说明不论受测者能力高低,都容易猜对本道题目。反应理论同经典测试理论相比,具有以下优点:

题目参数估计更为准确。全面解决测试等值问题。定义了信息函数这一综合质量指标,作为更科学地挑选题目的标准。适合编制自适应测试系统。计算机化自适应测试 )图二在传统测试中,对于每个考生而言,题目中只有一部分是符合自己真正能力的,其余的题目要简单,要么过难。因为 具有参数不变性,它不受测样本影响,同时可以根据题目的信息量图二选择难度与受测者能力相匹配的题目。所以以理论为指导,建立计算机化自适应测试系统是现实可行的。是指在以理论为基础建立的题库之上,不断地根据题目的各方面信息和受测者的答题估计受测者的能力,然后从题库中选取符合受测者能力的题目进行测试,直到达到预定的测试度要求,即可结束测试。整个测试过程如图二所示:下面对 系统进行测试的各个环节加以详细描述。建立题库题库是进行测试的基础,高质量的题库应具有优质、量大、等值、动态可扩充等特点。 题建立有以下几个步骤:1选择模型,首先应选择适应的 模型,如常用的三参数型。在此模型的基础上上,建立题库中题目的规格标准。)题目的开发,开发应按题库命题格标准进行,应注重不同知识内容与能力层次、不同难度和不同题型的结合,对开发的试卷应织审查,确保题目的质量。3题目参数的确定,主要是对题目各参数值的确定,一般有途径:一是经试测后统计分析,另一种是由专家进行评估后,再采用统计方法确定参数。4的动态维护,基于 的题库在建库完成后,一般无法再进行题库的扩充,而基于的题库因为 理论具有参数不变性等优点,题库的扩充变的更为容易,只需安排一些连接题目与新目相混合进行试测,就可以将新题目的参数值与旧题目的参数值统一到一张量表中来。参数初始化参数的初始化是指在受测者在进行测试之前,对受测者的能力值进行初始估计,一般有以下几方法:I选择中等难度的试卷,即假定受测者的能力为中等,在题库中随机抽取难度为中等目,作为测试的开始点。2根据历史记录确定受测者的初始能力值,受测者可能参加过测试.据以前的测试记录决定此次的开始题目,或根据以前其他受测者的测试记录决定开始题目。3受测者自行选择,由受测者自行决定自匚程度,选择测试起始题目。能力估计估计受测者的能力是 顺利进行的前提,最常用的方法是极大似然估计法。若以"表示能力为日的受测者对题目 的反应为手对,%=1答错,%=的概率。则)以目数:受测者答对第题的概率:受测者答错第题的概率(通常称为似然函数,我们要对每一个反应向量犍,*币……〃")求出相应的日值,使似然函数的值为最大。我们以弋逐次迭代求出能力的极大似然估计值苗)。=g-%ga:'+L1为第+次迭代的能力估计值。尸⑹尸⑹=口工岂-尸⑹尸⑹=口工岂-一公〕i-lZ?工门也产「甲温F西2-1典目编号I%’勺:第题的区分度、难度、猜测系数受测者答对第题的概率受测者答错第题的概率受测者的反应答对为受测者答对第题的概率受测者答错第题的概率受测者的反应答对为1答错为)方法,极大似然估计法估计受测者能力值的最大好处是简便实用,它比较适合于题目较多的情况,在其它情况下,我们可以采取两种方法相结合的途径估计受测者能力。方法,选择题目用题目的抽取和受测者能力相适应的题目是 的基本原则。通常,我们利用 题库中题目的最大信息函数来确定所选择的题目。用题目的数’⑹来表示题目参数与受测者能力的关系。,)=耳之网1/,)=耳之网1/[片网,口⑻卜受测者能力估计值I%'勺:第题的区分度、难度、猜测系数,量具有可加性,可以随时估计一组试卷施测的信息量的总和。不同能力的受测者,题目有不同的信息量,信息量取最大值时,它所对应的能力值即是最适合于采用此题目测试的人员的能力值。因此方法选取试卷。它是以能力估计值系统中,根据前面推测的能力值,系统搜寻相应信息量最大的题目进行测试。另外,还可以采用;之后的改变作为选择标准,即选择使得能力估计值在测试之后改变最小的题目进行测试。方法选取试卷。它是以能力估计值终止条件以达到测试的最大容量作为测试的终止条件。另外,还可以以能力估计值达到预定的精度要求作为终止条件,即当受测者的能力估计值下来时,便可以结束测试。基于的自适应测试系统基于的自适应测试系统技术的发展使得测试的技术手段和载体发生了革命性的变化, 的开放性、分布性的特点和基于 的巨大的计算能试突破了时间和空间的限制。基于 的测试系统正成为人们的研究热点之一,如在英国,已经实现了英语资格测试的网上学习和证全过程。:机网络技术的发展和自适应测试理论的日渐成熟使得基于 的自适应测试系统成为现实。基于 的自适应测试系统可以发挥网络的建立大型、高效、共享的题库和实现随时随地的测试,降低测试成本,并使得对于受测者的评测更为正确和客观。采用 结构和 结构相结合的方法实现基于 的自适应测试系统。其中,面向少量用户的题库子系统出于安全等方面的考虑,采用 结构实现,而测试子系统采用基于 的方式完成。

莪皖官理察面:系筑管理靠护题目检资留筑监窗褥卿史题需查功

莪皖官理察面:系筑管理靠护题目检资留筑监窗褥卿史题需查功

王丽恒事数的调整子系统主要完成题库的建立及维护工作。其功能结构示意图如图三所示:图三子系统有三大功能:)题库的建立。首先应确定试卷的模式,如试卷的题型、分值、层次、要求等。然后进行题目的录入,在录入过程应进行即时监控,以确保题目的正确性和一致性。录入后的题目需经过预测或专家评测后运用统计方法确定题目的参数区分度、难猜测参数等)。〕题库的维护。应具有基本的管理功能,如添加、删除、更新题目等,在题库扩充是,应注意连接题目的选择及新增题:的确定。同时还应具有方便的查询功能,用户可以根据题型、难度或复合条件查询题库中的题目。〕系统的管理,包括日常的管理工作身份验证、数据的存储管理等),还应有一定的统计分析功能,它可以将题库的质量等指标反馈给管理者,作为题库发展的依据。子系统完成在线测试工作。系统采用基于的三层模型实现,三层应用模型同传统的客户机服务器模型相比,提高了系统的可寸安全性和可重用性。它将应用逻辑与用户界面和数据访问相剥离,这样便使系统的维护变得简单,同时简化客户端功能,用户只需有浏,即可使用测试系统。其系统结构示意图如图四所示:试子系统中,客户端的任务主要是:确定测试的起始点与结束点、与用户交互、题目的呈现、估计用户能力值。端负责处理用户I求和对用户测试记录的更新,同时接受客户端的请求,在题库中选择与用户能力估计值相应的题目。・系统工作流程如下:经过客户端的界面代理和测试代理向发出登录请求。端的测试代理接收用户请求后,通过用户记录代理查询用户资料库,是否接受用户登录。若通过,则根据用户的记录确定测试的初始题目,返回给客户端。在测试中,界面代理处理与用户的交互,并负责七.现工作,客户端的测试代理通过界面代理得知用户的反应,便可经过计算估计用户的能力值。首先判定是否以达到测试的预定测试要求,I,则测试结束,向端传递相应信息。如未达到,则向端的测试代理请求与该能力估计值相适应的题目,同时传送用户答隹应数据如答题时间、反应类型等)。端的测试代理接受用户反应数据后,通过用户记录代理更新用户的测试记录。并将客户端的题目请求传送给相应题库代理。相应的题库代题库,选择库中最适合该用户测试的题目,即相对该能力估计值的题目信息量最大的题目,返回给 端的测试代理。测试代理返回给客户端的测试代理,并通过界面代理呈现给用户。在测试结束后,用户便可即时通过客户端的分析代理得知自己的测试信息,如在整个测试中能力估计值的变化曲线等信息。还可得到分析总结后的数据,使得用户可以改进日后的学习。在 端,也有相应的系:模块,它负责整个系统的协调管理。同时也对系统的运行数据进行统计分析,以促进系统的改进。出于对 环境的考虑,我们在以下几个方面作了改进:进行在线测试时,计算量主要集中在两大部分:一是客户端对受测者的能力的估计,二是 端对于题目的选择。其中第二部分的计统整体性能影响较大。如果很精确地找到符合受测者测试的题目,需要根据题目的 参数和用户能力的估计值,计算各试卷的信息函中选出信息量最大的题目,而这需要大量的计算,在 并发的环境下,服务器的负载变大,从而延长了用户的等待时间。而响应用户来说很重要,如果等待时间过长,用户将会放弃,因此,需要在测试的精确度与系统的效率间进行折衷,为减小服务器的计算量,用高效算法提高查找能力的同时,在题目入库时,确定此题目最适合的测试者的能力值,根据公式可得出题目所适合测试的能力值:测试时,在符合受测者能力范围的题目中根据某些选题策略如随机选取题目、选取最少引用题目等)选择试卷,反馈给测试者。从而简.线测试时服务器端的运算。初始题目选择的策略机环境下,初始题目可以从适合中等能力的测试者测试的题目中选取,也可以根据受测者的资料来预计受测者的能力从而选取初始题目环境下,前者很容易导致测试从相同的起点开始,后者可能因为用户的资料不够齐全而无法预测,我们在系统中采用了预测题的即在系统中选取适应不同能力的典型试卷若干,根据用户的反应预计用户的能力,从而选取相应的初始试卷,同时,受测者也可以把这为考前的热身准备。题目预取技术测试是在估计受测者能力的基础上,在题库中搜索适合测试的题目进行测试,在 环境下,如果每测试一题后,都需要从数据库一道题目,这样可能会因为网络的拥挤而导致题目与题目之间的间隔过长,从而影响测试,为了避免词类情况的发生,我们采取题目预:来提高测试系统的效率,即我们从数据库中选取题目时,预先估计受测者的反应,估计反应后的能力值,选取与其相对应的题目传送给受测者在作完一道题目时,取出的是本地的文件,从而减少了网

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论