两阶段博弈.ppt_第1页
两阶段博弈.ppt_第2页
两阶段博弈.ppt_第3页
两阶段博弈.ppt_第4页
两阶段博弈.ppt_第5页
已阅读5页,还剩14页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

1、完全非完美信息两阶段博弈,第3章和第4章要点,Outline of Unit 3 and 4,完全非完美信息两阶段博弈:时间顺序,博弈的过程按一系列的阶段进行,下一阶段开始前参与人可观察到前面所有阶段的行动。本节我们允许每一阶段中存在着同时行动,这就包含了非完美信息。 1. 参与人1和2同时从各自的可行集 A1和 A2 中选择行动a1和a2; 2. 参与人3和4观察到第一阶段的结果(a1, a2),然后同时从各自的 可行集 A3和 A4中选择行动a3和a4; 3. 收益为ui(a1, a2, a3, a4) , i = 1,2,3,4。,完全非完美信息两阶段博弈: 后向归纳法,我们仍然沿用后向

2、归纳的思路解决此类博弈问题。 但这里从博弈的最后阶段后向推导的第一步就包含了求解一个真正的博弈(给定第一阶段结果时,参与人3和4在第二阶段同 时行动的博 弈),而不再是前一节求解单人最优化的决策问题。 为了简化问题,本节中我们假设对第一阶段博弈每一个可能结果(a1, a2),第二阶段博弈(参与人3和4之间的博弈)有唯一的纳什均衡,表示为,如果参与人1和2预测到参与人3和4在第二阶段的行动为对第一阶段行动的最优反应,则参与人1和2在第一阶段的问题就可用以下的同时行动博弈表示: 1. 参与人1和2同时从各自的可行集 A1和 A2 中选择行动a1和 a2; 2. 收益情况为ui(a1, a2, a3

3、*(a1,a2), a4 *(a1,a2) , i =1,2; 假定(a1*,a2*)为以上同时行动博弈唯一的纳什均衡,我们称 (a1*, a2*, a3*(a1*,a2*), a4 *(a1*,a2*) 为这一两阶段博弈的子博弈完 美解。此解与完全且完美博弈中的后向归纳解在性质上是一致的,并且与后者有着类似的优点和不足。,完全非完美信息两阶段博弈:子博弈完美结果,完全非完美信息两阶段博弈:不可置信的威胁,如果参与人3和4威胁在后面的第二阶段博弈中,他们将不选 择纳什均衡下的行动,参与人1和2是不会相信的,因为当博 弈真的进行到第二阶段时,参与人3和4至少有一个人不愿把 威胁变为现实(这是因为

4、它不是第二阶段博弈的纳什均 衡)。 另一方面,假设参与人1与参与人3是同一个人,并且参与人1在第一阶段并不选择a1*,参与人4就会重新考虑参与人3(即参与人1) 在第二阶段将会选择a3*(a1,a2)的选择。,工作竞赛: 描述,考虑为同一老板工作的两个工人,工人 (其中 等于1或2)生产的产 出 ,其中 是努力程度, 是随机扰动项。生产的程序如下:第 一,两个工人同时选择非负的努力水平 ;第二,随机扰动项 和 相互独立,并服从期望值为0、密度函数为 的概率分布;第三,工人的产 出可以观察,但各自选择的努力水平无法观测,从而工人的工资可以决定于 各人的产出,却无法(直接)取决于其努 力水平 。,

5、参考拉齐尔和罗森(1981)首先建立的分析模型。假设老板为激励工人努力工作,而在他们中间开展工作竞赛,工作竞赛的优胜者(即产出水平较高 的工人)获得的工资为 ;失败者的工资为 。工人获得工资水平 并付 出努力 程度时的收益为 ,其中 表示努力工作带来的负效 用,是递增的凸函数(即 且 )。老板的收益为 。,工作竞赛: 两阶段博弈,现在我们套用2.2.A节博弈类型的讨论思路来分析这一应用。 老板为参与人1,他的行动a1是选择工作竞赛中的工资水平 和 , 这里不存在参与人2。 两个工人是参与人3和4,他们观测第一阶段选定的工资水平,然后同 时选择行动a3和a4,具体地说就是选定的努力程度 和 。(

6、后面 我们将考虑另一种可能性,就是老板选定的工资水平,工人们不愿意 参与工作竞赛,却寻找另外的工作机会)最后,参与人各自的收益如 前面所给出。 由于产出(并由此而使工资)不只是参与人行动的函数,而且同时还 受随机扰动因素 和 的影响,我们用参与人的期望收益进行分析。,工作竞赛: 博弈的时序,工作竞赛: 后向归纳法,分析 第1步. 工人同时选择努力程度 和 . 假定老板已选定了工资水平 和 ,如果一对努力水平 是第二阶段两工人博弈的纳什均衡,则对每个 , 必须使 工人的期望工资减去努力带来的负效用后的净收益最大,亦即 必须满足: 其中,也就是说,工人 选择努力程度 ,从而使得额外努力的 边际负效

7、用 ,等于增加努力的边际收益,后者等于 对优胜者的奖励工资 ,乘以因努力程度提高而使获 胜概率的增加 。,工作竞赛: 后向归纳法,(2.2.4)的一阶条件为:,工作竞赛: 后向归纳法,于是,一阶条件(2.2.5)可化为:,在对称的纳什均衡(即 ),我们有:,(2.2.6),工作竞赛: 后向归纳法,由于是 凸函数,优胜获得的奖励越高(即 的值越大),就会激发更大的努力,这和我们的直觉是一致的。另一方面,在同样的奖励水平下,对产出的随机扰动因素越大,越不值得努力工作,因为这时工作竞赛的最终结果在很大程度上是由运气而非努力程度决定的。例如,当 服从方差为 的正态分布时,则有,它随 的增加而下降,也就

8、是说 的确随 的增加而降低。,第2步 我们现在从后往前分析博弈的第一阶段. 假定工人们同意参加工作竞赛(而不是另谋高就),他们对给定 和 的反 应,将会是(2.2.6)描述的对称的纳什均衡战略。 (从而我们忽略掉存在不对称均衡的可能性,以及工人的努力程度 由角点解 而不是由一阶条件(2.2.5)给出的可能性)。 同时假定工人可寻求其他就业机会,得到的效用为 。因为 在对称的纳什均衡中每个工人在竞赛中获得优胜的概率为1/2 (即 ) ,如果老板要使工人有动力参加工作 竞赛,则他必须选择满足下式的工资水平,工作竞赛: 后向归纳法,工作竞赛: 后向归纳法,假设 足够低,以至于老板愿意激励工人参加竞赛

9、, 则他会在(2.2.7)的约束条件下,选择使自己期望收益 最大的工资水平。由于在最优条件下,(2.2.7) 中的等号成立:,期望利润成为 ,于是老板要考虑的问题 就是使 最大化,这时他选择的工资水平应使得与之 相应的 满足这一条件。从而最优选择下的努力程度满足 一阶条件 ,将其代入(2.2.6)则意味着最优激励满足,工作竞赛: 后向归纳法,和(2.2.8)一起,可解得 和 的值。,Common knowledge,The game was meant to test whether player R is certain that player C will take the action which is clearly optimal for player C. The outcome (A,A) is the best outcome for both players, and player C has no reason to punish player R by playing B Nevertheless, player R may be uncertain as to whether player C will employ the correct reasoning.,Play

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论