(教育技术学专业论文)基于语义web技术和本体论的网络教育资源建设研究.pdf_第1页
(教育技术学专业论文)基于语义web技术和本体论的网络教育资源建设研究.pdf_第2页
(教育技术学专业论文)基于语义web技术和本体论的网络教育资源建设研究.pdf_第3页
(教育技术学专业论文)基于语义web技术和本体论的网络教育资源建设研究.pdf_第4页
(教育技术学专业论文)基于语义web技术和本体论的网络教育资源建设研究.pdf_第5页
已阅读5页,还剩75页未读 继续免费阅读

(教育技术学专业论文)基于语义web技术和本体论的网络教育资源建设研究.pdf.pdf 免费下载

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

基于语义w c b 技术和本体论的网络教育资源建设研究 论文摘要 近二十年来,随着i n t e m e t 的迅猛发展,网络教育,作为当代远程教育的 一一种重要形式,已经成为当今教育的重要组成部分。然而由于网络资源应用标准 不兼容、语义定义不严格、有效性和结构化缺乏等问题,网络发展尤其是网络教 育应用出现了严重的瓶颈。针对当前网络中的居多弊端,”mb e m e r s l e e 提 出了语义w e b 这一全新的网络理念和技术,并引入和应用了本体论的相关理念。 语义w e b 通过扩展现有网络,在信息中加入表示其含义的内容,语义w e b 中的 各种资源不再只是各种相连的信息,还包括其信息的真正含义,真正实现w e b 语义化,从而提高计算机处理信息的自动化和智能化。 本文首先简要介绍了语义w e b 的主要理论和技术,并重点分析了本体论。 然后重点研究了当今网络教育中存在的问题,并分析且找出了问题的根源一一网 络教育资源。随后分析元数据针对网络资源问题的解决方法,而且指出了元数据 方法的不足之处。进而提出了运用语义w e b 技术和本体论从元数据层次进行网 络资源建设的方案和框架。在此框架下进行了可行性研究,并且构建了网络教育 语义模型,在软件工程方法论和思想的指导下,采用o w l 语言,进行了网络教 育领域本体建设实践,开发了领域本体t r a v e l o w i 。最后对网络教育资源领域 本体的利用进行了探讨,其中研究了本体资源的存储方法,再研究本体的资源检 索问题,并且用j a v a 对运用o w l 语言描述的本体进行检索,开发了语义w e b 检索实验系统,虽然系统还不够完善,但还是证明了本体资源检索的可行性。 本文的主要创新在于采用语义w e b 和本体论的理念,从教育元数据的角度 对当前网络教育资源进行审视、分析和评价,并且进行了网络教育资源领域本体 建设的初步实践。 关键词:语义w e b 本体论网络教育资源x m lr d f r d f so w l 基于语义w e b 技术和本体论的网络教育资源建设研究 a b s t r a c t a st h er a p i dg r o w t ho fi n t e r n e t ,n e t w o r ke d u c a t i o nt h a ti sa n t 1 p o r t a n tt y p e o ft h ed i s t a 九c ee d u c a t i o n ,h a sb e e na ni m p o r 七a n tp a r 七o fc u r r e n te d u c a t i o ni n t h ep a s to ft w e n t yy e a r s h o w e v e t h ec r t e r i o no fw e br e s o u r c ei sn o t c o n l p a t i b f e t h es e m a n t i cd e f j n i t l o nj sn o ts t n c t t h ev a d i t ya 介dt h e w e - s t r u c u r ea r ea b s e n t t h e r ei sas e r j o u sb o t t j e n e c kj nt h ep r o g r e s so f i n t e r n e te s p e c i a yn e t w o r k - e d u c a t i o na p pj i c a t i o n s ot i mb e r n e r s l e eb r o u g h t f o n a r dt h es e m a n t cw e ba n do n t o l o g y w et r yt oe t e n dc u r r e n ti n t e r n e tb y i n s e r 七i n gt h ec o n t e n tt h a td e n o t e ss o m em e a n i n g s i nt h es e m a n t i cw e b ,a k i n d so fr e s o u r c e sa r en o to n i yc o n j o i n ti n f o r m a “o n ,b u ta i s oc o n t a i nt h er e a i m e a n i n g s0 ft h ei n f o r m a t i o n s ot h ea u t o m a t i z a t i o na n di n t e g e n c e0 ft h e c o m p u t e ri sb o o s t e dj nt h e 厅e j di n f b r m a t i o nd j s p o s a j i nt h et h e s i st h ep r m a r yt h e o r ya n dt e c h n o i o g yo ft h es e m a n t l cw e ba r e f i r s t i yp r e s e n t e d ,t h e nt h ea n a i y s i so fo n t o i o g yt h e o r y s o m ep r o b i e m si nt h e n e 七w o r ke d u c a t i o na r es t u d i e d 1 1 1 er o o to ft h ed r o b l e mi sf o u n d t h er o o ti s f r o mo fn e t w o r ke d u c a 七1 0 nf t e s o u r c e af r a m ef o rn e t w o r ke d u c a t l o nr e s o u r c e c r e a t i o ni sp u tf o r w a r dt h a ti sf r o mt h em e t a d a t aa n dt h r o u 9 he x e r 七i o no ft h e s e m a n t j cw e ba n dt h e0 n t o j 0 9y i nt h ef r a m e ,s o m ef e a s j b 订j t y ,e s e a r c hc a nb e d o n ea n das e m a n t i cm o d e li sc o n s t r u c t e df o rt h en e t w o r ke d u c a t i o n u n d e rt h e m e t h o d o l o g yo fs o f t w a r ee n g i n e er n g ,t h e r ei sap r a c t i c ef o rt h ec r e a “o no ft h e n e t w o r ke d u c a t l o nd o m a i no n t o i o gy _ w h a t ,sm o r e ,o n ed o m a i n - o n t o i o g y0 f 、。r a v e i o w i s d e v e l o p e db a s e do no w l - i a n g u a g e f i n a l l l ns o m eu t i l i z a t i o n r e s e a r c h e sa r ed o n ef o rd o m a i n o n t 0 1 0 9 y ,i n c i u d i n gd o m a i n o n t o i o g ys t o r a g e m e a n sa n dd n t o i o g ys e a r c h as e m a 几t j cw e bs e a r c he x p er j m e n ts y s t e mi s d e v e i o p e dt h a ti sn o tp e r f e c tb u tt e s t i f i e so n t 0 i o g ys e a r c hf e a s i b i | i t y t h ei n n o v a t o n so f 七h e s i sa r e a sf o i l o w e d t h es e m a n t cw e ba n dt h e o n t o i o g ya r ea d o p t e d t h ec u r r e n tn e t w o r ke d u c a t i o nr e s o u r c ea r es u r v e y e d a n da n a i y z e da n dv a l u e di n 七h ew a yo fe d u c a t i o nm e t a d a t a t h ec r e a t i o no f n e t w o r ke d u c a t i o nd o n l a ;no n t o i o g yi sp r a c t i c e d k e y w o r d s : t h es e m a n t i cw e b o n t o l o g y - x h l r d f r d f s o w l n e t w o r ke d u c a t i o nr e s o u r c e i i 基于语义w c b 技术和本体论的网络教育资源建醪研究 图表目录 图2 1 语义w e b 层次图6 图2 2x m l 的应用模型9 图2 3r d f 三元组1 1 图3 1 网络教育系统组成1 5 图3 2 基于语义w e b 的网络教育系统框架2 2 图4 - 1o n t o i o g y 语言栈3 6 图4 - 2o w ll i t e d l 相关类和属性的层构造图3 7 图5 1 教育资源语义模型的体系结构4 1 图5 2 学习资源元数据4 2 图5 3 编写旅游本体类的界面5 5 图5 4 编写旅游本体属性的界面5 6 图5 5 旅游本体类层次关系图5 7 图5 6 旅游本体各类之间的逻辑关系图5 8 图6 1m y s q l 存储界面6 1 图6 2p r o t 知查询界面6 4 图6 3 】e n a 的接口定义6 5 图6 4 实验系统方案6 7 图6 5 本体检索主界面6 8 图6 6 第一次检索后返回本体资源界面6 9 图6 7 进一步查看相关本体资源界面6 9 表“1 本体的定义2 5 表4 2g u a r i n o 概念分类理论的概念特性2 8 表4 3w 3 c 语义w e b 栈3 5 表4 - 4o n t o l o g y 头部分说明3 6 表5 1 本体实例列表4 4 表6 1 卜1 y s q l 数据库中对应本体数据的含义6 1 学位论文独创性声明 本人所呈交的学位论文是我在导师的指导下进行的研究工作及取得的研究 成果。据我所知,除文中已经注明引用的内容外,本论文不包含其他个人已经 发表或撰写过的研究成果。对本文的研究做出重要贡献的个人和集体,均已在 文中作了明确说明并表示谢意。 作者签名:纽约丛 学位论文使用授权声明 日期:乏型:兰:墨 本人完全了解华东师范大学有关保留、使用学位论文的规定,学校有权保 留学位论文并向国家主管部门或其指定机构送交论文的电子版和纸质版。有权 将学位论文用于非赢利目的的少量复制并允许论文进入学校图书馆被查阅。有 权将学位论文的内容编入有关数据库进行检索。有权将学位论文的标题和摘要 汇编出版。保密的学位论文在解密后适用本规定。 学位论文作者签名:讯式 日期:丝! :! : 导师签名: 日期: 琨矽堆 乒卯占6 第1 章引言 1 1 立论依据 1 1 。1 论文的研究意义 第1 章引言 当前、 f e b 主要以h 丌p h t 卜1 l 为基础,支持人与人、人与机器、机器与机 器之间语法上的互操作,很难支持语义互操作。语义w e b 通过扩展现有互联网, 在信息中加入表示其含义的内容,语义w e b 中的各种资源不再只是各种相连的 信息,还包括其信息的真正含义,真正实现w e b 语义化,从而提高计算机处理 信息的自动化和智能化。在语义w e b 的协议栈中,x m l 为信息交换和共享提供 了语法支持,r d f 为描述w e b 上的资源提供了元数据表达标准。 网络教育,作为当代远程教育的一种重要形式,俨然成为当今教育的重要组 成部分,网络教育不仅是传统教育的有力补充,而且网络教育是实现全民教育, 继续教育和终身教育的重要保证。在网络教育系统的开发中,教育资源是重要的 组成部分。学生不受地域、时空上的限制进行探索式学习,为他们提供大量、全 面、开放的资源是网络教育成功的必要条件。然而,当前网络教育资源的开发和 利用不令人满意。主要原因是缺乏统一的格式和交换标准以及通用的技术手段, 形成信息孤岛,难以进行有效的资源检索,不同系统之间无法实现资源共享。 随着语义w e b 研究不断深入和实践的不断发展,特别是x 卜1 l 和r d f 技术 的日趋成熟,以及0 w l 语言被w 3 c 认定,使得语义w e b 为有效地开发、管 理和使用网络教育资源提供了解决方法。 1 i 2 国内外研究现状分析 目前,世界上有很多标准化( 学术) 组织都正在致力于基于网络的教育资源 标准化的研究,并起草了一些相应规范,其中影响较大的有:i h s 的l e a m _ n g r e s o u r c em e t a d a t a ( 学习资源元数据规范) ,i e e el t s c ( l e a r n _ n g t e c h n o l o g ys t a n d a r d sc o m m i t t e e ,学习技术标准委员会) 的l o 卜1 ( l e a m i n go b j e c t 卜1 e t a d a t a :学习对象元数据模型) 、0 c l e ( o n n e c o m p u t e rl | b r a r yc e n t e r ) d u b nc o r e 的d u b nc o r e 元数据标准等。我 国在这方面的研究也踏上正轨,国家教育部科技司已组织专家拟定了现代远程 教育工程教育资源建设技术规范的征求意见稿,为建设国家级、地区级和单位 级的教育资源库提供了最基本的参考标准。承担教育资源建设的各类主管部门应 成立资源建设专家组,在国家颁布的标准化规范基础上,保留原有的核心集,并 第1 章引言 根据资源库建设的规模、适用范围和当地的具体情况,开发出各自的扩展规范集。 现在这些标准都是基于传统网络观念和技术下的,虽然做了很多优化资源结 构和互操作的努力和尝试,也取得了一定的成果。但我认为这些标准没有从本质 和根本上解决现有问题。采取全新的语义w e b 技术和本体论,从元数据出发, 采用x m i 、r d f 和0 w l 定义网络教育资源,能根本上解决问题。 l - 2 研究方案 1 2 1 研究目标、研究内容和拟解决的关键问题 由于当前语义w e b 的研究还是一个全新的领域,相关理论和实践还不够成 熟,因此本研究论文的拟定目标是:- 首先在理论上证明语义w e b 的可行性,特 别是在网络教育资源开发中的可行性。然后尝试着针对网络教育中某一领域的课 程资源,运用语义w e b 的协议栈和技术进行标准化开发,初步实现资源语义级 的共享和检索。 1 、本论文作为一种全新的有关网络教育资源的研究,主要包括: ( 1 ) x m l 描述网络教育资源研究; ( 2 ) 运用r d f 进行网络教育资源描述和框架的研究; ( 3 ) 综合运用x h l r d f 及o w l 语言建设网络教育资源知识模型并构建 领域本体; ( 4 ) 使用开源代码软件j e n a 解析网络教育领域本体知识库。 2 、拟解决的关键问题包括两个: ( 1 ) 建立基于语义本体的网络教育资源库: 总所周知,目前现在网络教育资源的查询和检索是基于关键字的,不同系统 无法实现共享,如何运用现有的语义w e b 协议下的元数据开发语言描述和定义 具有语义的网络教育资源是关键: 、 ( 2 ) 实现不同系统网络教育资源间的转换: 将已有的网络教育资源标准化为符合语义w e b 协议的资源,这样能较大范 围共享网络教育资源,但这是个规模较大的系统工程,因此本人尝试着做一个简 单本体案例。 1 2 2 拟采取的研究方法、技术路线、实验方案及可行性分析 1 拟采取的研究方法 本论文的研究首先主要通过建立科学的假设,理论证明,采用相关技术实验 研究的方法。具体有: 2 第1 章引言 文献研究:证明网络资源存在问题; 对比研究:先分析语义w e b 在其它领域的应用研究情况,然后分析网络教 育的特殊性,找到语义w e b 应用于网络教育资源的可行性和具体方法; 实验研究:网络教育资源库试运行于现有的网络教育系统,反复改进。 2 技术路线 对语义w e b 的理念和相关思想再深入研究,抓住语义w e b 的精髓; 对当前的网络教育资源统计分析,找出其主要问题;再对国内外流行的网络 教育资源标准化研究现状进行分析,找出其优点和不足; 分析语义w e b 相关标准和技术,本论文的研究重点技术: ( 1 ) x 卜1 l ( 可扩展标志语言) 提供语法支持: ( 2 ) r d f ( 资源描述框架) 定义元数据; ( 3 ) 运用o w l 构建某一领域本体知识库: ( 4 ) 开源软件】e n a ; ( 5 ) 】s d 、s e r v l e t ,t o m c a t ,曲u i l d e r 等。 3 。实验方案 软件和服务:w i 几d o w ss e 厂v e r2 0 0 0 ,j a v a ,】e n a ,p r o t g 芭 整个解决方案基于使用】a v a 和o p e ns o u r c e 作为操作平台,使用p r o t 的 开发环境进行开发,元数据是r d f 格式,】e n a 对元数据解析,利用】s p 开发 检索界面。 、 4 可行性分析 语义w e b 中的信息是以机器可以处理的信息为目标,真正实现w e b 形式化 和语义化。在语义w e b 的协议栈中,x m l 为信息交换和共享提供了语法支持, r d f 为描述w e b 上的资源提供了元数据表达标准。o n t o i o g y ( 本体) 的主要成 分是一整套对某一领域里的知识进行表述的词和术语,本人根据某一知识领域的 结构将这些词和术语组成登记类目,同时规定类目的特性及其之间的关系。这样 0 n t o i o g y 就能提供机器能够理解的信息结构,且使得某一领域知识能够被再利 用。语义w e b 是一个很大的系统,完全实现系统是不可能的,本论文研究是就 某一特定领域运用语义w e b 的理论和技术改良网络教育资源结构,并一定程度 上实现资源语义的尝试性实践,所以是能取得研究成果的。 1 3 论文框架 本论文现拟定为七章: 第1 章:引言。分析论文的研究背景,确定论文研究方案,并确定论文的 框架。 第1 章引言 第2 章:语义w e b 及其相关理论和技术。简要介绍语义w e b 的概念和起 源、组成、关键技术等。 第3 章:网络教育资源与语义w e b 。先分析当前网络教育资源的弊端,进 而分析当前教育资源元数据的研究现状,发现其教育技术标准不足之处,从而提 出语义w e b 对网络教育资源进行改造,构造了全新的网络教育框架。 第4 章:本体论分析。本体是语义w e b 的基础,全面分析本体相关理论和 方法,为构建网络教育资源本体提供依据和策略。 第5 章:网络教育资源领域本体的构建。系统的分析了本体构建方法,并 研究了本体构建相关实例,最后构建了领域本体_ i r a v e i o w i 。 第6 章:基于本体的网络教育资源的存储和检索。在领域本体的基础上探 讨了本体资源的存储和检索问题,最后进行了本体资源解析、读取和检索的实验, 并开放了语义w e b 检索实验系统。 第7 章:总结与展望。总结论文的主要创新点以及不足之处,并对后续研 究做了展望和计划。 第2 市语义w e b 及其相关理论和技术 第2 章语义w e b 及其相关理论和技术 近几年来,语义w e b ( s e m a n t i cw e b ) 研究逐渐引起知识表示、逻辑编 程、信息系统、w e b 开发等各个领域的广泛关注。语义w e b 的研究将对传统 w e b 上信息的发布、存储和处理方式产生一场变革。下面分析了语义w e b 的起 源、概念和技术框架,并总结了语义w e b 及其相关研究应用的现状。 2 1 语义w e b 的概念和起源 语义w e b 是个全新的概念,关于其定义和起源,以及与人工智能的区别和 联系很容易让人产生误解,下面阐述了语义w e b 的概念和起源。 2 1 _ 1w e b 的演化阶段 w e b 创始人t | mb e m e r s l e e 将w e b 的演化分为两个阶段,在第一阶段, w e b 应该是一个有利于人们相互合作的强大工具。w e b 在最初十年的发展基本 上实现了这个目标:它以h t m l 页面的方式提供了大量信息。在第二阶段,这 种合作应该延伸到机器。即连接到w e b 上的机器也应该能够分析w e b 上的所 有数据。w e b 海量的信息要求以一种能够理解数据语义的方式进行交换和管理, 当前基于h t m l 的w e b 技术却是很难满足要求的。 2 1 。2 语义w e b 的概念 t i mb e m e r s - l e e 对语义w e b 作了如下的描述:语义w e b 并不是一个孤 立的万维网,而是对当前万维网的扩展,语义w e b 上的信息具有良好的含义, 使得计算机之间以及人类能够更好的彼此合作。 根据上面的描述,我们可以给语义w e b 做出这样的定义:机器可以理解数 据含义的下一代w e b ,称之为语义w e b ,语义w e b 中的语义表示计算机对某 一概念、术语或者符号可以理解的“含义”。 2 1 3 语义w e b 和传统人工智能系统比较 从语义w e b 的发展起源来看,语义w e b 是人工智能领域和w e b 技术结合 的产物。人工智能领域中的知识工程研究从孤立的知识库系统逐渐发展到基于 i n t r a n e t 、e x t r a n e t 的信息系统集成,最后扩展到整个i n t e m e t ,在这个研究 过程中,逐渐加深了对知识表示和推理的认识,并结合了一些新的描述和推理方 法。另一方面,w e b 经过十几年的发展,积累的海量数据需要一种新的、机器 第2 章语义曲及其相关理论和技术 可以自动完成的方式来处理和管理。因此,当两个领域的积累都比较成熟,而且 有了需求,就必然会走向结合。 2 2 语义w e b 的组成 语义w e b 的知识表示具有创建上的分散性,同时又具有应用上的通用性,所 以需要一个统一的框架,这个框架能够满足这种分散性以及由这种分散性所带来 的安全性,满足这些知识跨应用、跨领域的可操作性。 b e r n e r s l e e 在x m l 2 0 0 0 大会上描述了这个体系结构( 如图2 1 所示) 。 下文对这个框架从底层到高层,逐渐地介绍每一个部分的概况和功能。 r u i e s t r u s t d a t a p r o o f d i g l - s e l f d a t at a l 矿 l o g i c d e s c 剑g n 矿 0 n t o l o g y a t u r e d o c f r d f + r d f s c h e m a x h l + n s + x m l s c h e m a u n i c o d eu r i s 2 2 1u n i c o d e 和u r i s 图2 1 语义w e b 层次图 u n i c o d e 是一个字符集,这个字符集中所有字符都用两个字节表示,可以表 示6 5 5 3 6 个字符,基本上包括了世界上所有语言的字符。数据格式采用u n i c o d e 的好处就是它支持世界上所有主要语言的混合,并且可以同时进行检索。 u r i s ( u n i f o r mr e s o u r c ei d e n t i f i e r s ) ,即统一资源标识符,用于唯一标 识网络上的一个概念或资源。在语义w e b 体系结构中,该层是整个语义w e b 的 基础。其中u n i c o d e 负责处理资源的编码,u r i s 负责资源的标识。 w e b 环境下的应用之间不可避免地需要相互通信,直接或者间接地以机器 可读的格式传递发布信息。这些信息很大部分是对w e b 上资源的描述,因此, 首先应该以明确的方式来标识这些资源( 对象) 。语义w e b 采用u r i s 来标识资 源及其属性,u r i s 足一个i n t e 厂n e t 标准,记载于r f c 2 3 9 6 。它和万维网常用的 第2 章语义w c b 及其相关理论和技术 统一资源定位符( u n i f o r mr e s o u r c el o c a t o r ,u r l ) 以及统一资源名称 ( u n i f o r mr e s o u r c en a m e ,u r n ) 的区别在于u r i s 泛指所有以字符串标识 的网络资源,包括u r l 平口u r n 。另外由于语义w e b 的最终目的是要构建一个全 球信息的网络,在这个网络上应该涵盖各种语言和文字的信息资源,所以它采用 统一编码u n i c o d e 作为字符的编码方案。这一层是整个语义w e b 的基石,它成 功地解决了万维网上资源的定位和跨地区字符编码的标准格式问题。 2 2 2x m l + n s + x m l s c h e m a x m l 是一个精简的s g ml ,它综合了s g 卜1 l 的丰富功能与h t 卜1 l 的易用性。 它允许用户在文档中加入任意的结构,而无需说明这些结构的含意。 n s ( n a m es p a c e ) 即命名空间,由u r i s 索引确定,目的是为了避免不同的 应用使用同样的字符描述不同的事物。 x h ls c h e m a 是d t d ( d o c u m e n td a t at y p e ) 的替代品,它本身采用m l 语法,但比d t d 更加灵活,提供更多的数据类型,能更好地有效地为x h l 文档 服务并提供数据校验机制。 正是由于卜1 l 灵活的结构性、由u r i s 索引的n s 而带来的数据可确定性以及 x 卜1 ls c h e m a 所提供的多种数据类型及检验机制,使其成为语义w e b 体系结构 的重要组成部分。该层负责从语法上表示数据的内容和结构,通过使用标准的语 言将网络信息的表现形式、数据结构和内容分离。 2 2 3rdf+rdfs c h e m a r d f 是一种描述w w w 上的信息资源的一种语言,其目标是建立一种供多种 元数据标准共存的框架。该框架能充分利用各种元数据的优势,进行基于w e b 的数据交换和再利用。r d f 解决的是如何采用x h l 标准语法无二义性地描述资 源对象的问题,使得所描述的资源的元数据信息成为机器可理解的信息。如果把 x m l 看作为一种标准化的元数据语法规范的话,那么r d f 就可以看作为一种标 准化的元数据语义描述规范。 r d f s c h e m a 使用一种机器可以理解的体系来定义描述资源的词汇,其目的 是提供词汇嵌入的机制或框架,在该框架下多种词汇可以集成在一起实现对 w e b 资源的描述。 2 2 40 n t o l o g y 0 n t o i o g y ( 本体或本体论) 原本是一个哲学上的概念,用于研究客观世界本 第2 章语义w e b 及其相关理论和技术 质。它是一份正式定义名词之间关系的文档或文件。一般w e b 上的o n t o i o g y 包 括分类和一套推理规则。分类用于定义对象的类别及其之间的关系,推理规则提 供进一步的功能,完成语义w e b 的关键目标即“机器可理解”。本体的最终目 标是“精确地表示那些隐含( 或不明确的) 信息。 该层是在r d f ( s ) 基础上定义的概念及其关系的抽象描述,用于描述应用领 域的知识,描述各类资源及资源之间的关系,实现对词汇表的扩展。在这一层, 用户不仅可以定义概念而且可以定义概念之间丰富的关系。 2 2 5l o g i c 、p r o o f & t r u s t l o g i c 负责提供公理和推理规则。l o g i c 一旦建立,便可以通过逻辑推理对 资源、资源之间的关系以及推理结果进行验证,证明其有效性。 通过p r o o 皎换以及数字签名,建立一定的信任关系,从而证明语义w e b 输 出的可靠性以及其是否符合用户的要求。 p r o o f 和t r u s t 这部分内容在概念上目前还没有一个成熟的说法。但是语义 w e b 的研究者普遍认为p r o o f 和t r u s t 将是下一代w e b 的重要概念。总的来说, 语义w e b 环境下的应用在事实的基础上,通过应用逻辑推理,得出某种结论。这 种推理的每一步对用户来说,都应该可见的,或者说应该是可查的。首先我们应 该可以信任所见的数据,并且可以信任所做的推理过程,只有在这个基础上爿能 最终信任我们得到的结论。 然而,就我们所见的数据而言,前面介绍的r d f 模型允许任何人对任何资源 进行任何描述,不同观点的人对同样的资源可能会做出完全相反的描述。正是因 为r d f 模型这种强大的描述能力,才有必要对这种描述行为本身认证并确保声明 没有被篡改。因此在语义w e b 的层次体系结构中,从r d f 层以上,所有对资源的 描述都贯穿了数字签名技术。数字签名技术就是对资源描述者的身份进行认证的 关键性技术,是建立可信任网页的基石。建立可以信任的推理过程需要一个证明 语言,证明语言提供了一种方法来描述我们从事实开始到得出结论中间的步骤。 这些证明步骤可以被验证、传递。 在x m l 、r d f r d f s 、o n t o i o g y 以及l o g i c 层和p r o o f 层之上,我们就可以 建立一些可以信任的应用了。 2 3 语义w e b 的关键技术 语义w e b 概念的提出和发展得益于许多相关的技术和理念的产生分发展, 其中最重要的有三大关键技术:x 卜1 l 、r d f 和0 n t o i o g y ( 本体) 。 第2 章语义曲及其相关理论和技术 2 。3 。1x m l 技术 m l ( e t e n s i b l em a r k u pl a n g u a g e ,可扩展标记语言) 是w 3 c ( w o r i d w i d ew e bc o n s o r t u m ,万维网联盟) 推荐的下一代网页发布语言,是一种定 义标记语言的工具。x 卜1 l 是s g m l ( s t a n d a r dg e n e r a l i z em a r k u p l a n g u a g e ,标准通用标记语言) 的子集,保存了s g h l 可扩展性、结构化和有 效性等特点。虽然,x m l 和h t m l 都是s g 卜1 l 的子集,由于在扩展性问题上的 差异,相比较而言,h t m l 是对w e b 页面的数据显示风格的描述,而m l 是 对w e b 页面数据的描述。x h l 使用简单灵活的标准格式,为基于w e b 上的应 用提供了一个描述数据和交换数据的有效手段。 x m l 用来描述结构化数据,包括以下几个方面内容:d t d ( d o c u m e n t t y p e d e f i l l i t i o n 文档类型定义,x s l ( e x t e n s b | es t y f e s h e e tl a n g u a g e 可扩展 样式语言) 和l l ( e x t e n s b i el | n kl a n g u a g e 可扩展链接语言) 等。 d t d 规定了m l 文件的逻辑结构,定义了m l 文件中的元素、元素的属 性以及元素与元素之间的关系。它可以帮助x m l 的分析程序校验x h l 文档标 记的合法性:x s l 是用于规定x 卜1 l 文档样式的语言,它能在客户端使w e b 浏 览器改变文档的表示法,从而不需要再与服务器进行交互;x l l 将进一步扩展目 前w e b 的简单链接。 x 卜1 l 中的另一个基本概念是x 卜1 ln a m e s p a c e ( x m l 名字空间) ,指的是 应用程序接口x m l 的a p i 中间件x m l 文档 图2 2x 卜1 l 的应用模型 x h l 文档引用多个d t d 的标记的机制,通过在域前加入d t d 的引用前缀,可 以避免不同组织使用相同名称的标记而引起的冲突。由于x 卜1 l 提供了一套把不 同信息源的数据用统一的方法进行数据结构化的机制,就为w e b 上的资源提供 第2 章语义w c b 及其相关理论和技术 了一种统格式,使信息独立于平台之间,x m l 文档的结构化表示,使数据的 提取更容易。 x m l 作为一种资源描述语言,不仅提供对资源内容的表示,同时也提供资 源所具有的结构信息。x m l 让每个人都可以创建自己的标记,允许用户在文档 中加入任意的结构,但无须说明这些结构的含义。对于语义网来说,仅有x m l 是不够的,还需要提供描述m l 资源的元数据( 即m e t a d a t a ,是关于数据的数 据,也就是对所描述的又像结构或内容所作的规范说明) 。r d f 是w 3 c 推荐的 用于描述和处理元数据的一个草案,是处理元数据的基础。 2 3 2r d f 技术 r d f ( r e s o u r c ed e s c r i p “o nf r a m e w o r k ,资源描述框架) ,是w 3 c 推 荐的一种通用的元数据结构,是描述和交换元数据的框架,是处理元数据的基础。 它用x m l 进行表达,其目的是提供一个访问网络资源元数据的标准,因此也提 供了一个描述特定资源内容的标准协议。r d f 解决的是如何采用x m l 标准语法 无二义性的描述资源对象的问题,使得所描述的资源的元数据信息成为计算机可 以理解的信息。如果我们把m l 看作一种标准化的元数据规范,那么r d f 就 可以看作为一种标准化的元数据语言描述规范。r d f 通过基于x h l 语法的明确 的结构化约定来帮助建立语言协议和语法编码之间的桥梁,以此来促进元数据的 互操作能力。r d f 本身并不规范语义,但是它为每个资源描述体系提供定义反 映某特定需求的语义结构的能力。从这个意义上讲,r d f 是一个开放的元数据 框架。 语义w e b 的首要目的就是要让计算机能够对信息的语义进行处理,作为 w 3 c 标准的r d f 为基于元数据的语义表示提供了基础。r d f 为在w e b 上应用 系统间进行机器可理解信息的交换提供了互操作能力。 r d f 建立在一个称为三元组的数学模型上,每一个“三元组”有主语 ( s u b j e c t ) ,谓语( p r e d i c a t e ) 和宾语( 0 b j e c t ) 三个元素组成。由一个特 定资源、资源的属性、资源的属性值构成的三元组,又称为一个r d f 陈述。其 中主语代表资源:以u r i s 可唯一确定的任何对象,指向所有r d f 表达式描述 的事物。资源可能是部分、完整网页或者网页集,也可能是w e b 不能直接访问 的对象;谓语指的是资源的属性,包括资源的特点、性质与其它资源之间的关系 等等:宾语指的是属性的值,可以是另一个资源或文字数据。 r d f 中的三元组是由u r i s ( u n i v e r s ajr e s o u r c ei d e n t i f i e 广s 统一资源标 识符) 识别的。给每个不同的概念应用不同的u r i s ,可以解决语义网同一领域 一词多义的问题。考虑下面的三元组: 第2 章语义w c b 及其相关理论和技术 ( p u b i s h e r ,h t t p :w w w w 3 o r g ,”w o r l dw i d ew e bc o n s o r t i u m ”) 其中该三元组的主语是h t t p :w w w w 3 o r g ;谓语是p u b i i s h e r ;宾语是 “w o r l dw i d e 、 f e bc o n s o r t i u m ”。这个三元组的图形表示如下图: 图2 3r d f 三元组 三元组和图形是同一个r d f 模型的两种不同表示方法。还可以用x 卜1 l 文档来 表示r d f 模型。 r d f 用容器( c o n t a i n e r ) 这个概念来表示事物的集合。r d f 有三种容器 类型,包( b a g ) 、序列( s e q u e n c e ) 和选择( a l t e m a t i v e ) 。包和序列均用 于表示具有多个值的资源或者文字的集合,包中的值可以是无序的,序列中的值 必须是有序。选择则表示具有可选值的资源或者是文字的集合。 r d f 所提供的建模原语非常基础,因此需要r d fs c h e m a 对其作进一步扩 展。r d f s c h e m a 提供了一种把r d f 映射到x m l 文本的方法。r d f s c h e m a 中描述了x h l 文本的语法,同时也提供了一种对象类的定义方法,并且基于这 种定义方法描述x m l 文本中的语义信息。其中包括几个重要概念;提出了类 ( c l a s s ) 的概念;不但描述存在那些主要属性,也可以描述属性从属于哪些类, 提出了( c o n t a i n ) 的感念。r d f s c h e m a 与其他类型系统的区别在于 r d f s c h e m a 对c i a s s 的特殊定义,一般对象系统通过c i a s s 拥有属性来定义 c i a s s ,而r d f s c h e m a 中c i a s s 是一种资源( r e s o u r c e ) 的分类方法,类定 义里并不描述它有说明属性,而是属性描述c l a s s 与资源之间的关系。 x 卜1 l 与r d f 结合可以比较好的解决计算机知识表示问题。x m l 可以帮助解 决语法异构的问题,机器可以从用m l 格式的信息表示中提取信息内容和信息 的组织结构。同时,r d f 可以帮助解决语义异构的问题,它提供了表达知识和 规则的概念模型。但是用x m l 和r d f 并不能解决在不同领域中处理语义时存 在的两个问题:( 1 ) 同一概念有多种词汇表示;( 2 ) 同一个词有多种含义( 概 念) 。为了解决上述两个问题,很自然的需要引入o n t o l o g y 。 2 3 3 本体( o n t o l o g y ) 技术 本体,信息的集合( c o i i e c t i o n ) 。在哲学上,本体是有关存在的本质以及 何种事物存在的理论,这是它作为一门学科所研究的理论。 第2 章语义w e b 及其相关理论和技术 本体包含5 个基本的建模元语( m o d e n gp r i m i t i v e ) ,分别是:类( c i a s s ) 、 关系( r e i a t i o n s ) 、函数( f u n c t i o n s ) 、公理( a x l o m s ) 和实例( i n s t a n c e s ) 。 实例表示的就是对象。而类表示的则是对象的集合,关系对应于对象元组的集合, 类的定义一般采用框架( f r a m e ) 结构,包括类的名称、与其他类之间关系的 集合以及自然语言对该类的描述。基本的关系有4 种:d a r t - o f ,k i n d o f , i n s t a n c e - o f ,和a t t r b u t e o f 。p a r t - o f 表示类之间部分与整体的关

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论