版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
1、第第1010讲讲:有限理性博弈(:有限理性博弈(I I):):具有具有快速学习能力的小群体成员的反复快速学习能力的小群体成员的反复博弈博弈1 1OUTLINE1 1、完全理性、完全理性& &有限理性有限理性2 2、具有快速学习能力的小群体成员的反复博弈:一、具有快速学习能力的小群体成员的反复博弈:一般分析思路般分析思路3 3、协调博弈的有限理性博弈方快速学习模型、协调博弈的有限理性博弈方快速学习模型4 4、进化稳定策略(、进化稳定策略(Evolutionary Stable StrategyEvolutionary Stable Strategy:ESSESS)21 1、完全理
2、性、完全理性& &有限理性有限理性3完全理性完全理性经济学通常假设人们有完全理性经济学通常假设人们有完全理性有始终追求最大利益的完美意识、分析推理能力、识别有始终追求最大利益的完美意识、分析推理能力、识别判断能力、记忆能力和准确行为能力。判断能力、记忆能力和准确行为能力。4 4完全理性完全理性&有限理性有限理性经济学通常假设人们有完全理性,但这种假设的现经济学通常假设人们有完全理性,但这种假设的现实性是有问题的。实性是有问题的。事实上,人们只是在分析处理比较简单问题时接近完全事实上,人们只是在分析处理比较简单问题时接近完全理性要求,但在分析复杂问题时理性的局限性很明显。
3、理性要求,但在分析复杂问题时理性的局限性很明显。5 5完全理性完全理性&有限理性有限理性基于博弈方具有基于博弈方具有完全理性完全理性的假设,我们已经分析了:的假设,我们已经分析了:完全信息静态博弈完全信息静态博弈完全且完美信息动态博弈完全且完美信息动态博弈重复博弈重复博弈6 6完全理性完全理性&有限理性有限理性博弈问题通常包含复杂的相互依存关系,博弈分析博弈问题通常包含复杂的相互依存关系,博弈分析往往是很复杂的,因此指望现实的博弈方都能通过往往是很复杂的,因此指望现实的博弈方都能通过博弈分析找到最优策略,而且不会因为遗忘、失误、博弈分析找到最优策略,而且不会因为遗忘、失误、任性
4、等原因偏离最佳选择,常常是不切实际的。任性等原因偏离最佳选择,常常是不切实际的。7 7完全理性完全理性&有限理性有限理性如果我们只是在如果我们只是在完全理性完全理性假设下进行博弈分析,显假设下进行博弈分析,显然是不够的,会影响博弈论的适用范围和价值。然是不够的,会影响博弈论的适用范围和价值。8 8完全理性完全理性&有限理性有限理性理性理性完全理性完全理性有完美的分析判断能力和不会犯选择行为的错误。有完美的分析判断能力和不会犯选择行为的错误。有限理性(有限理性(Boundedly RationalBoundedly Rational)不满足完全理性假设,即博弈方的判断选择能力有缺
5、陷。不满足完全理性假设,即博弈方的判断选择能力有缺陷。9 9完全理性完全理性&有限理性有限理性博弈问题博弈问题“完全理性博弈完全理性博弈”所有博弈方均符合完全理性假设下的博弈问题。所有博弈方均符合完全理性假设下的博弈问题。“有限理性博弈有限理性博弈”博弈方的判断选择能力有缺陷情况下的博弈问题。博弈方的判断选择能力有缺陷情况下的博弈问题。1010完全理性完全理性&有限理性有限理性有限理性博弈有限理性博弈1111完全理性完全理性&有限理性有限理性有限理性意味着博弈方往往不会一开始就找到有限理性意味着博弈方往往不会一开始就找到最优策略,会在博弈过程中学习博弈,必须通最优策略,
6、会在博弈过程中学习博弈,必须通过试错寻找较好的策略;过试错寻找较好的策略;有限理性也意味着一般至少存在部分博弈方不有限理性也意味着一般至少存在部分博弈方不会采用完全理性博弈的均衡策略;会采用完全理性博弈的均衡策略;有限理性还意味着均衡是不断调整和改进而不有限理性还意味着均衡是不断调整和改进而不是一次性选择的结果,而且即使达到了均衡也是一次性选择的结果,而且即使达到了均衡也可能再次偏离。可能再次偏离。1212完全理性完全理性&有限理性有限理性需要引入新的分析方法需要引入新的分析方法 1313有限理性博弈有限理性博弈典型的有限理性博弈典型的有限理性博弈(1 1)具有快速学习能力的小群体成员
7、的反复博弈)具有快速学习能力的小群体成员的反复博弈(2 2)学习速度较慢的成员组成的大群体随机配对的)学习速度较慢的成员组成的大群体随机配对的反复博弈反复博弈14142 2、具有快速学习能力的小群体成员的反复博弈:一、具有快速学习能力的小群体成员的反复博弈:一般分析思路般分析思路15具有快速学习能力的小群体成员的反复博弈具有快速学习能力的小群体成员的反复博弈具有快速学习能力的小群体成员的反复博弈具有快速学习能力的小群体成员的反复博弈博弈方的理性层次较高、学习速度较快,能迅速调整策博弈方的理性层次较高、学习速度较快,能迅速调整策略。略。1616具有快速学习能力的小群体成员的反复博弈(具有快速学习
8、能力的小群体成员的反复博弈(续续)一般分析思路:一般分析思路:(1 1)()(初始条件初始条件)初次进行博弈时,各别博弈方的)初次进行博弈时,各别博弈方的策略选择;策略选择;(2 2)博弈方相互博弈、学习和模仿的环境条件;)博弈方相互博弈、学习和模仿的环境条件;(3 3)博弈方的理性层次决定的学习和策略调整的方)博弈方的理性层次决定的学习和策略调整的方式、特征。式、特征。1717博弈方的理性层次决定的学习和策略调整的方式、特征。博弈方的理性层次决定的学习和策略调整的方式、特征。策略调整机制:最优反应动态(策略调整机制:最优反应动态(Best-Response Best-Response Dyn
9、amicsDynamics)给定前期的经验(即博弈结果),各个博弈方本期都能给定前期的经验(即博弈结果),各个博弈方本期都能找到和采用针对前期其他博弈方策略的最佳反应策略。找到和采用针对前期其他博弈方策略的最佳反应策略。183 3、协调博弈的有限理性博弈方快速学习模型、协调博弈的有限理性博弈方快速学习模型19具有快速学习能力的小群体成员的反复博弈(具有快速学习能力的小群体成员的反复博弈(续续)例:例:协调博弈的有限理性博弈方快速学习模协调博弈的有限理性博弈方快速学习模型型2020协调博弈的有限理性博弈方快速学习模型协调博弈的有限理性博弈方快速学习模型协调博弈的有限理性博弈方快速学习模型协调博弈
10、的有限理性博弈方快速学习模型2121有有5 5个有限理性博弈方,分别位个有限理性博弈方,分别位于图示圆周的于图示圆周的5 5个位置上;个位置上;每个博弈方都与各自的左右邻居每个博弈方都与各自的左右邻居反复博弈。反复博弈。博弈方的博弈内容是博弈方的博弈内容是 “ “协调博弈协调博弈”(Coordination GameCoordination Game)。)。 博弈方相互博弈、学习和博弈方相互博弈、学习和模仿的环境条件模仿的环境条件协调博弈的有限理性博弈方快速学习模型(协调博弈的有限理性博弈方快速学习模型(续续)2222博弈方博弈方2AB博弈方博弈方1A50,5049,0B0,4960,60具有
11、两个纯策略纳什均衡(具有两个纯策略纳什均衡(A A,A A)和()和(B B,B B) 协调博弈的有限理性博弈方快速学习模型(协调博弈的有限理性博弈方快速学习模型(续续)假设博弈方虽然缺乏分析交互动态关系和预见能力,但假设博弈方虽然缺乏分析交互动态关系和预见能力,但是能够马上对上一阶段的博弈结果进行总结,并立即做是能够马上对上一阶段的博弈结果进行总结,并立即做出相应的策略调整。(出相应的策略调整。(最优反应动态:最优反应动态:给定前期的经验给定前期的经验(即博弈结果),各个博弈方本期都能找到和采用针对前期其他博(即博弈结果),各个博弈方本期都能找到和采用针对前期其他博弈方策略的最佳反应策略。弈
12、方策略的最佳反应策略。 )2323 协调博弈的有限理性博弈方快速学习模型(协调博弈的有限理性博弈方快速学习模型(续续)博弈方的理性层次决定的学习和策略调整的方式、博弈方的理性层次决定的学习和策略调整的方式、特征特征2424假设假设 xi(t) 为在为在 t 时期博弈方时期博弈方 i 的邻居中采用的邻居中采用A策略的数量,该策略的数量,该数量有数量有0、1、2三个可能值。采三个可能值。采用用B策略的邻居的数量相应为策略的邻居的数量相应为2xi(t),也有,也有0、1、2三个可能三个可能值。值。协调博弈的有限理性博弈方快速学习模型(协调博弈的有限理性博弈方快速学习模型(续续)针对第针对第 t 期的
13、相关情况期的相关情况 xi(t) ,博弈方,博弈方 i 采用策略采用策略A的得益为的得益为xi(t)502 xi(t)49, 博弈方博弈方 i采用策略采用策略B则得益为则得益为xi(t)02 xi(t)60。25博弈方博弈方2AB博弈方博弈方1A50,5049,0B0,4960,60 :协调博弈的有限理性博弈方快速学习模型(协调博弈的有限理性博弈方快速学习模型(续续)根据最优反应动态机制,当根据最优反应动态机制,当xi(t)502xi(t) 49 xi(t)02xi(t) 60即即xi(t)22/61时,博弈方时,博弈方 i 在在t+1时期会采用时期会采用A,而,而当当xi(t)502xi(t
14、) 49 xi(t)02xi(t) 60即即xi(t)22/61时,博弈方时,博弈方 i 在在t+1时期会采用时期会采用B。 2626博弈方博弈方2AB博弈方博弈方1A50,5049,0B0,4960,60协调博弈的有限理性博弈方快速学习模型(协调博弈的有限理性博弈方快速学习模型(续续)由于由于 xi(t) 只能取只能取0、1、2这三个整数,因此上述反这三个整数,因此上述反应机制实际上就是:应机制实际上就是:如果在如果在 t 时期博弈方时期博弈方 i 的两个邻居中只要有的两个邻居中只要有1个采用个采用A,那么博弈方那么博弈方 i在第在第t+1时期采用时期采用A;如如 果在果在 t 时期博弈方时
15、期博弈方 i 的两个邻居都没有采用的两个邻居都没有采用A,那么,那么博弈方博弈方 i 在在t+1时期采用时期采用B。27协调博弈的有限理性博弈方快速学习模型(协调博弈的有限理性博弈方快速学习模型(续续)初次进行博弈时,各别博弈方的策略选择初次进行博弈时,各别博弈方的策略选择(博弈方都是有限理性的博弈方都是有限理性的)初次博弈总共有)初次博弈总共有 2 25 53232种种可能的情况。可能的情况。2828博弈方博弈方2AB博弈方博弈方1A50,5049,0B0,4960,60协调博弈的有限理性博弈方快速学习模型(协调博弈的有限理性博弈方快速学习模型(续续)但是,这但是,这3232种情况中不少实质
16、上是相同的,只是哪个博种情况中不少实质上是相同的,只是哪个博弈方采用弈方采用A A或或B B有所不同,把圆周作一定的旋转就能完全有所不同,把圆周作一定的旋转就能完全重合。重合。2929协调博弈的有限理性博弈方快速学习模型(协调博弈的有限理性博弈方快速学习模型(续续)根据采用根据采用A A策略博弈方的数量和分布,总共有策略博弈方的数量和分布,总共有8 8种无实质差异,种无实质差异,无法通过圆周旋转而重合的情况:无法通过圆周旋转而重合的情况:(1 1)0A0A;(2 2)1A1A;(3 3)相邻)相邻2A2A;(4 4)不相邻)不相邻2A2A;(5 5)3 3连连A A;(6 6)非)非3 3连连
17、A A;(7 7)4A4A;(8 8)5A5A。3030协调博弈的有限理性博弈方快速学习模型(协调博弈的有限理性博弈方快速学习模型(续续)3131最优反应动态机制最优反应动态机制:如果在如果在 t t 时期博弈方时期博弈方 i i 的两个邻居中只要有的两个邻居中只要有1 1个采用个采用A A,那,那么博弈方么博弈方 i i在第在第t+1t+1时期采用时期采用A A,如果两个邻居都没有采用,如果两个邻居都没有采用A A,那么博弈方那么博弈方 i i 在在t+1t+1时期采用时期采用B B。B BB BB BB BB BB BB BB BB BB B情形情形1 1:初次博弈有:初次博弈有0 0个个
18、A A协调博弈的有限理性博弈方快速学习模型(协调博弈的有限理性博弈方快速学习模型(续续)情形情形2 2:初次博弈有:初次博弈有1 1个个A A3232协调博弈的有限理性博弈方快速学习模型(协调博弈的有限理性博弈方快速学习模型(续续)情形情形3 3:初次博弈有相邻:初次博弈有相邻2A2A3333协调博弈的有限理性博弈方快速学习模型(协调博弈的有限理性博弈方快速学习模型(续续)情形情形4 4:初次博弈有不相邻:初次博弈有不相邻2A2A3434协调博弈的有限理性博弈方快速学习模型(协调博弈的有限理性博弈方快速学习模型(续续)情形情形5 5:初次博弈有:初次博弈有3 3连连A A3535协调博弈的有限
19、理性博弈方快速学习模型(协调博弈的有限理性博弈方快速学习模型(续续)情形情形6 6:初次博弈有非:初次博弈有非3 3连连A A3636协调博弈的有限理性博弈方快速学习模型(协调博弈的有限理性博弈方快速学习模型(续续)情形情形7 7:初次博弈有:初次博弈有4A4A3737协调博弈的有限理性博弈方快速学习模型(协调博弈的有限理性博弈方快速学习模型(续续)情形情形8 8:初次博弈有:初次博弈有5A5A3838协调博弈的有限理性博弈方快速学习模型(协调博弈的有限理性博弈方快速学习模型(续续)总结:总结:除了初次博弈时所有博弈方都采用除了初次博弈时所有博弈方都采用B B的一种情况以外,从的一种情况以外,
20、从其余所有的情况出发,经过或多或少时期的最优反应动其余所有的情况出发,经过或多或少时期的最优反应动态法则的调整,最终都会收敛到所有博弈方都采用态法则的调整,最终都会收敛到所有博弈方都采用A A的稳的稳定状态。定状态。3939协调博弈的有限理性博弈方快速学习模型(协调博弈的有限理性博弈方快速学习模型(续续)“所有博弈方都采用所有博弈方都采用A A策略策略”和和“所有博弈方都采用所有博弈方都采用B B策略策略”都是有限理性博弈方进行上述协调博弈的都是有限理性博弈方进行上述协调博弈的稳稳定状态定状态,但前一种稳定状态显然要更重要一些。,但前一种稳定状态显然要更重要一些。在上述设定下,总共在上述设定下
21、,总共3232种可能的初次博弈情况中只有一种可能的初次博弈情况中只有一种是稳定于所有博弈方采用种是稳定于所有博弈方采用B B的状态,其余的状态,其余3131种都会收种都会收敛到采用敛到采用A A的状态。的状态。4040协调博弈的有限理性博弈方快速学习模型(协调博弈的有限理性博弈方快速学习模型(续续)“所有博弈方都采用所有博弈方都采用A”A”的稳定状态是具有的稳定状态是具有“稳健性稳健性”的的在达到所有博弈方都采用在达到所有博弈方都采用A A的稳定状态后,如果出现少数的稳定状态后,如果出现少数博弈方偏离博弈方偏离A A的情况,那么最优反应动态会使博弈方的策的情况,那么最优反应动态会使博弈方的策略
22、很快回到都采用略很快回到都采用A A的状态的状态 。4141协调博弈的有限理性博弈方快速学习模型(协调博弈的有限理性博弈方快速学习模型(续续)“所有博弈方都采用所有博弈方都采用B”B”的稳定状态不具有稳健性的稳定状态不具有稳健性一旦某个博弈方偏离一旦某个博弈方偏离B B,那么最优反应动态会使博弈方的,那么最优反应动态会使博弈方的策略离该稳定状态越来越远。策略离该稳定状态越来越远。4242差之毫厘,谬以千里差之毫厘,谬以千里43434 4、进化稳定策略(、进化稳定策略(Evolutionary Stable StrategyEvolutionary Stable Strategy:ESSESS)
23、44协调博弈的有限理性博弈方快速学习模型(协调博弈的有限理性博弈方快速学习模型(续续)进化稳定策略(进化稳定策略(Evolutionary Stable StrategyEvolutionary Stable Strategy:ESSESS)同时具有(同时具有(1 1)在博弈方的动态策略调整中会达到在博弈方的动态策略调整中会达到,又,又(2 2)对少量偏离的扰动有稳健性对少量偏离的扰动有稳健性这两个性质的稳定状态,这两个性质的稳定状态,在进化博弈中被称为在进化博弈中被称为“进化稳定策略进化稳定策略”。在上述协调博弈中,所有博弈方都采用在上述协调博弈中,所有博弈方都采用A A就是一个进化稳就是一
24、个进化稳定策略,而所有博弈方都采用定策略,而所有博弈方都采用B B则不是进化稳定策略。则不是进化稳定策略。4545有限理性博弈的一般分析思路有限理性博弈的一般分析思路一般分析思路:一般分析思路:(1 1)()(初始条件初始条件)初次进行博弈时,各别博弈方的策略)初次进行博弈时,各别博弈方的策略选择;选择;(2 2)博弈方相互博弈、学习和模仿的环境条件;)博弈方相互博弈、学习和模仿的环境条件;(3 3)博弈方的理性层次决定的学习和策略调整的方式、)博弈方的理性层次决定的学习和策略调整的方式、特征。特征。4646有限理性博弈方有多种不同的理性层次,学习的速度有限理性博弈方有多种不同的理性层次,学习的速度差别也很大。差别也很大。 4747有限理性博弈方有多种不同的理性层次,学习的速度有限理性博弈方有多种
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 城市桥梁日常夏季巡检养护实操课
- 车祸外伤急救现场急救课件
- 捕捉秋日微光奔赴成长远方
- 国际外贸综合试题及答案展示
- 【2024考研】全国统考数学一冲刺试卷(历年真题+模拟)
- 传统道德基础试题及完整答案
- 【2024考研】全国统考数学一历年真题(附解析版)
- 【2025考研】全国统考数学三期末试卷(按章节分类版)
- 跌倒预防护理教学查房课件
- 白内障外科治疗专家共识
- 2026年新教科版科学三年级上册第3课时 测量气温同步练习及参考答案
- 2026秋新教材人教版六年级上册美术全册教案
- 2026年西安邮电大学西邮伦敦城大国际项目中心招聘(2人)笔试参考题库及答案详解
- 2026年医师处方权高频试题(完整版)及答案
- 2026年第二次广东省普通高中学业水平合格性考试化学试题(含答案)
- 2026年秋季学期小学统编版四年级语文上册(新教材)教学计划含进度表
- 养老服务面试常见问题及解答
- 4.2《进入新时代的意义》课件- 2026-2027学年统编版道德与法治 九年级上册
- isight参数优化理论与实例详解
- GB/T 23800-2009有机热载体热稳定性测定法
- GB/T 11259-2015无损检测超声检测用钢参考试块的制作和控制方法
评论
0/150
提交评论