博弈论-落后的感应:国际象棋、战略和可信威胁

游戏:Zermelo 理论

  • 参与人:2 players
  • 完全信息博弈:一旦轮到某个人做决定时,他完全清楚的知道这个博弈前的变化,也就是说这些有顺序的决定都是在完全掌握信息的情况下做出的。
  • 游戏约束:这是个有限节数的游戏,不会无限延展循环下去
  • 游戏结果:
    • 一号参与人获胜,W1
    • 一号参与人落败,L1
    • 平局,T
  • 结论(可利用归纳证明法证明下面结论):
    • 作为参与人时有绝对把握胜利,参与人2落败
    • 平局
    • 作为参与人2时绝对有把握胜利,参与人1落败
  • 应用:国际象棋在完全信息博弈下进行有限次循环是有解的,可以达到平局状态
  • 归纳法证明理论
    1551608103(1).jpg

    1551616651(1).jpg

游戏:石子

  • 规则:有m*n的石子阵列,如果一个人选择了其中一块石头,我就会把所有处在这个石头左边和正上面之间的所有石子拿走,拿到最后一个石子的就是失败者
  • 上述理论说明,这个博弈必定有解,而解的结果是什么由N和M决定
  • 思考题:这个解是什么?也就是说这游戏的技巧是什么?
  • 定义1:完全信息博弈:在任一个节点上,或者说每个节点上的被轮到的参与者,都知道自己处在整个博弈的哪个节点的博弈(节点:树形图),也就是说参与者知道自己怎么走到该位置。
  • 定义2:一号参与人的纯策略是一个完整的行动计划,也就是说,这个纯策略明确了一号将在每一个节点采取怎样的策略

游戏

image.png
  • 问题:在这里二号参与人的策略是什么?
    • 如果参与人1选D,则参与人2不需要选择,如果参与人2需要选择,则参与人2选择r,在做逆向归纳时需要对后续节点进行考虑
    • 参与人1在这里一共有四种策略:[u/u,u/d,d/u,d,d],虽然1第一步选择d的时候,不需要进行第二次选择,但是仍然要考虑2做出选择时,本身应该要怎样选择
  • 收益矩阵:不使用逆向回归法,可以利用下表找纳什均衡,NE=(DDR,DUR)
策略 L R
u/u 2,4 0,2
u/d 3,1 0,2
d/u 1,0 1,0
d/d 1,0 1,0
  • 从这个游戏中可以知道,不能机械的找纳什均衡,在这个游戏中纳什均衡时,2采用的策略在1选择D后毫无意义,此时的投入就是浪费成本
  • 结论:如果一个均衡是建立在不足信的威胁的基础上,那么后面的参与者分析并做出的策略可能没有意义
最后编辑于
©著作权归作者所有,转载或内容合作请联系作者
【社区内容提示】社区部分内容疑似由AI辅助生成,浏览时请结合常识与多方信息审慎甄别。
平台声明:文章内容(如有图片或视频亦包括在内)由作者上传并发布,文章内容仅代表作者本人观点,简书系信息发布平台,仅提供信息存储服务。

相关阅读更多精彩内容

  • 大家早安、午安、晚安,今天我先从机器学习的学习中休息一下,来了解一些常见的博弈论模型,然后继续学习机器学习等。以下...
    keepStriving阅读 47,799评论 3 72
  • 首先对博弈与博弈论有个了解 博弈概念: 什么是博弈 博弈是指在一定的游戏规则约束下,基于直接相互作用的环境条件,...
    葵和海阅读 3,969评论 0 15
  • 一、什么是BRDBRD为“商业需求描述”的英语缩写,全称为:Business Requirement Docume...
    土包佬阅读 6,289评论 1 4
  • 或许是生活的变故让自己变得卑微,或许是性格使然从不轻易袒露怯懦。即使在那段伤痕累累的日子,也依旧笑得像七月的...
    sunny1991阅读 279评论 0 1
  • 【作者】陈德永【派别】文魁派【导师】袁文魁 【绘制心得】 政治的事情不乱讲,仅仅根据这部电影评价 【导图解说】 正...
    1组长陈德永阅读 430评论 0 0

友情链接更多精彩内容