人工神经网络和人机博弈_第1页
人工神经网络和人机博弈_第2页
人工神经网络和人机博弈_第3页
人工神经网络和人机博弈_第4页
人工神经网络和人机博弈_第5页
已阅读5页,还剩17页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

1、总目录总目录 生物学的神经网络生物学的神经网络 人工神经网络人工神经网络 神经网络的人机博弈应用神经网络的人机博弈应用 小实验:小实验:井字过三关井字过三关生物学的神经网络生物学的神经网络生物学的神经网络生物学的神经网络神经网络特点神经网络特点人工神经网络人工神经网络人工神经网络人工神经网络神经网络的人机博弈应用1988年,“深思”击败丹麦特级大师拉尔森1989年,每秒思考速度达200万步的“深思” 0 比2不敌卡斯帕罗夫1993年,“深思”二代击败了丹麦国家队,在与前女子世界冠军小波尔加的对抗中获胜1996年,性能高于“深思”数百倍的“深蓝” 以2比4负于卡斯帕罗夫1997年,“更深的蓝”

2、以3.5比2.5击败了卡斯帕罗夫2001年,一家德国公司开发的国际象棋软件“更弗里茨”击败了除克拉姆尼克之外的所有排名世界前十位的棋手2002年10月,“更弗里茨”与克拉姆尼克在巴林进行“人机大战”,双方以4比4战平2003年1至2月 由两位以色列电脑专家研究出的“更年少者”与卡斯帕罗夫对弈,双方3比3战平。1997年卡斯帕罗夫与深蓝2的人机大战2003年卡斯帕罗夫与更年少者的人机大战神经网络的人机博弈应用西洋双陆棋是西方一种状态空间比较大的棋类游戏。1992年,IBM的工程师TD-Gammon。在本例中使用的神经网络包含198 个输入节点、 80个隐含节点和1 个输出节点。其中输入节点输入的

3、是棋盘的局面特征,输出的是对棋盘的评估值。 有兴趣的可以参考有兴趣的可以参考莫建文等. 基于TD强化学习智能博弈程序的设计与实现J. 计算机应用,2004,24(6):287-288有兴趣的可以参考有兴趣的可以参考小实验:井字过三关 即课本第一章习题1.5中提到的tic-tac-toe。两个玩家,一个打圈(O),一个打叉(X),轮流在3乘3的格上打自己的符号,最先以横、直、斜连成一线则为胜。先下玩家有优势,双方无失误,将是和局。一个空白的棋盘一个空白的棋盘一场游戏的过程一场游戏的过程部分输入向量部分输入向量对应的目标输出值对应的目标输出值部分训练样例部分训练样例 实验利用Matlab中的神经网络工具箱来进行,将输入向量和目标输出分别保存为p_1和t_1两个文件,建立神经网络进行训练。学习速率取0.05,训练次数定为1000次。成功的例子成功的例子失败的例子失败的例子网络过于简单?应该下这一步应该下这一步也应该下这一步也应该下这一步进一步的改进利用多层前馈网络有兴趣的可以参考

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论