
博弈论关心你的核心利益——收益蛋糕和效用函数以及精益决策博弈论并不高深晦涩它研究博弈入局者的类型、信息不对称、各种博弈类型、入局者的互动关系、策略组合、纳什均衡、帕累托最优、既竞争又合作关系下的均衡占优解以及在各阶段博弈策略组合下的支付收益量化矩阵强调收集情报、研究对方的行为风格、规律特点、风险偏好、心智模式——预判你的预判算计你的算计推断你的推断应对你的应对博弈论广泛应用于人际关系、社交、职场、恋爱、婚姻家庭、商业竞争、公共政策决策、对阵对垒、各种谈判、大国决策中兵场、战场、情场、商场、名利场、大国博弈场...特别是人际关系作为社会性灵长类动物我们几乎每天都在和各种形形色色的人打交道博弈论也强调和美化合作强调同理心和集体理性来克制个克服经济学中关于人自私自利追求自身利益最大化理性经济人假设的缺陷也为经典却不最优的囚徒困境纳什均衡提供了更美好的决策理论依据从我个人的应用体会来说博弈论让我在一些关系处理和思考决策中通过理性分析和支付测算搭配合理的策略配合切实的行动让我获得了一些实实在在的好处和利益我是博弈论实战者、应用者和收获者博弈论专辑——【上】 【中】 【下】三篇完美覆盖博弈论经典理论不需要更多强烈推荐博弈论作者孙铂植目录1、什么是完全信息下的动态博弈2、动态博弈的分类3、博弈的阶段和扩展式表述4、博弈的扩展式表述的要素5、动态博弈的基本特点6、完全信息动态博弈的均衡7、博弈论中的策略行动行为模式8、策略中的可信性问题9、子博弈10、强盗分赃12、生活中有哪些办法可以提高策略行为的可信度13、重复博弈14、重复博弈的基本思想15、重复博弈的基本特征16、影响重复博弈均衡结果的因素17、合作的必要条件18、重复博弈与信誉19、《美德的起源》一书中关于博弈的描述20、不完全信息博弈简介21、注明的BF实验22、纸老虎博弈1、什么是完全信息下的动态博弈现实中博弈双方同时决策还面对很多依次决策后行者可以看到先行者的选择博弈各方先后依次行动2、动态博弈的分类根据博弈方是否相互了解信息动态博弈又可以分为完全信息动态博弈和不完全信息静态博弈静态博弈中无论是同时行动还是先后行动参与者均不能够在自己行动之前观测到别人的行动在动态博弈中参与者的行动一定分先后顺序后行动者能够在行动之前观测到先行动者的行动并据此进行自己下一步的行动决策人生有很多分叉路无论选择了哪条路后面还会继续分出岔路人的一生就是在和未来的自己博弈的过程3、博弈的阶段和扩展式表述动态博弈中每个参与者的选择行为分先后顺序依次相连其中一个博弈方的选择行为被称为一个阶段几个博弈方同时决策也构成一个阶段动态博弈中至少存在两个阶段动态博弈也被称为多阶段博弈或序贯博弈博弈的扩展式被称为博弈树动态博弈又被称为扩展式博弈博弈可以向任何方向延伸由一些点和线段组成点包括起点、中间点和终点起点又称为起始决策点起点是博弈树之根是博弈的开始也是最先行动者的起点4、博弈的扩展式表述的要素参与者集合、参与者的行动顺序即谁在什么时候行动、参与者的行动选择空间、参与者知道的信息集、参与者在行动结束后得到的支付函数、自然选择外生事件的概率分布博弈树基本构建包括节、枝和信息集节分为决策节和终点节枝表示从决策节到后续节的连线信息集的完美信息是指在博弈者的每次行动中参与者完全知道博弈的历史5、动态博弈的基本特点参与者是依次、多次决策形成多个阶段决策具有完全性计划具有过程性得益具有不可分性博弈方具有非对称性动态博弈中决策具有次序性在依次完成决策的过程中后者总能通过观察前者的决策而获得更多信息来做出更具有针对性的选择6、完全信息动态博弈的均衡一以房地产开发博弈为例两个房产商真的会按照实现设计好的策略方案行动吗纳什均衡中博弈方是否采取行动取决于方案的可信性7、博弈论中的策略行动行为模式威胁是指对不肯与你合作的对手进行惩罚的一种回应规则是一种有条件的策略如恐怖分子劫持人质要求答应他所有的条件不然就会杀光人质强迫性威胁的用意在于促使对方按照自己的要求行动阻吓性威胁的用意在于阻止对方的某些行动当威胁作为讨价还价的策略时这种威胁就很可能是不可置信的如古巴导弹危机核大国的核博弈只有一个均衡结果——核和平博弈论中的许诺是指诱使对方采取对自己有利的策略行为通过影响对方的预期判断而限制对方的选择强迫有强迫性许诺和阻吓性许诺威胁和许诺的结果都可能会陷入同样的结局——如果对方这样做或不做事先的行动是否还算数这涉及到行动的可行性问题需要注意威胁和许诺必须是有行为对应的而不是一个简单的警告或单方面的保证威胁和许诺是必须有条件的要求呢提前确定一个回应规则威胁是惩罚不按你意愿行事的参与者的回应规则许诺是对那些按你意愿进行行事的参与者的一种给与或奖励我们会时常在生活或工作中思考什么时候使用威胁、什么时候使用许诺承诺是一种无条件的策略承诺行动博弈结果已经改变行动变得可信8、策略中的可信性问题一房地产开发承诺为例它是一个完美信息博弈A先行动B在知道A的选择后再行动存在三个纳什均衡如果你朋友找你借钱投资并承诺投资成功后分一定的收益给你如果没有任何制度或规则约束借钱分收益就是一个不可置信许诺最好是打借条订立合同约束9、子博弈是动态博弈的局部次级博弈是原博弈的一部分也可以作为一个独立的博弈被加以分析甄别和剔除不可置信解就可以精炼子博弈纳什均衡10、强盗分赃属于完美信息动态博弈每个强盗都可以看到其他强盗之前的决策也可以推断出其他强盗所能采取的策略和相应的收益这个博弈的特征是次序起到关键作用这个博弈中存在策略的依存性问题某一参与者的策略不是仅仅取决于自己而是需要考虑别人的策略后再进行决策12、生活中有哪些办法可以提高策略行为的可信度承诺行动的成本越高威胁的可信度越高签订合同、建立信誉、不可逆转、分步前进、边缘政策、建立团队、授权代理人都可以提高策略行为的可信度要让承诺可信直截了当的方法就是同意你在不遵守承诺的时候接受惩罚签订合同并让独立于合同的第三方负责强迫执行承诺或收取罚金建立信誉如果呢尝试了一个策略然后反悔你可能会丧失可信度方面的信誉当机遇千载难逢百年一遇那么承诺价值也不大可以撕毁承诺一般地你都会在同一时间和不同对手进行多个博弈因此你有建立信誉的动机这就相当于做出一个承诺以使自己的策略行动显得可信说话算话的重要性在大国政治保证说到做到也正是解决策略行动可行性问题的核心总有办法使策略变得不可动摇如切断沟通如一份最后的遗嘱或证词中的条款如军队切断退路破釜沉舟背水一战都是属于不可逆转的策略剥夺了改变承诺的机会如两家厂商达成巧妙的价格联盟冻结价格战保证对方不会背叛和降价迅速察觉背叛行为并给予惩罚分步前进如多边贸易谈判把一个大目标分成多个足够小的目标逐个博弈分步前进在谈判进程中被普遍使用可以增进双方的了解产生互信将谈判分成若干次如签订合同分期付款房主担心偷工减料或者粗制滥造工程承包商担心房主一旦工程竣工可能会拒绝付款因此合同中的支付条款一般是分期付款边缘政策危急时刻不能循序渐进分步前进只需要一个能让人近乎让人相信的行动就能把问题解决如冷战边缘政策通过军事行动将事情推到战争的边缘以说服其他国家服从自己的政治要求把事情推到它的边缘而没有演化为战争的能力是必要的艺术边缘政策到达战争的边缘如今世界各国依然以核抗核、以守为攻来威慑对方保持克制核战争就是现代世界战争的边缘虽然选择边缘政策策略可能有效但是会恶化博弈双方的关系在谈判中奖威胁步步紧逼从而将威胁步步放大可以达到增强策略行动可信性的问题如用枪指着头逐步扣下扳机威胁对方吐出秘密建立团队以为有其他人的监督和督促守信就不难授权代理人寻找第三方加入以确保可信性做法如工会谈判授权第三方公证监督部落谈判请来酋长尊者有人监督要注意授权人与原合同的结果无利益关系这样才能监督执行实现守信的目的13、重复博弈是指同样结构的博弈重复多次实际上构成动态博弈在囚徒困境博弈中有效的取胜策略是以牙还牙以眼还眼人家怎么对你你也怎么对他这个策略在开局时选择合作以后则模仿对手在上一期的行动14、重复博弈的基本思想囚徒困境所反映的深刻问题是人类的个人理性有时能导致集体的非理性——聪明的人类会因为自己的聪明而作茧自缚单词发生的囚徒困境和多次重复的囚徒困境结果不一样如果博弈能被反复进行每隔参与者都有机会去惩罚另一个与前一回合的不合作行为这时合作就可能会作为均衡结果出现以牙还牙以眼还眼以其人之道还治其人之身体现了这种报复性惩罚且通过这一策略克洛伊引发博弈的结束以牙还牙策略使使对方欺骗的动机可能被惩罚的威胁所克服从而可能会导致一个较好的、合作的结果反复接近无数次无限次纳什均衡趋向于帕累托最优例如在囚徒困境中两个囚犯的刑期都不是很长刑满释放后又作案作案之后又被判刑释放后再作案再判刑如此反复他们之间就是重复博弈重复博弈中每一次的博弈不会改变下一次博弈的结构所有参与者都可以观测到博弈过去的历史15、重复博弈的基本特征前一阶段的博弈不改变后一阶段的博弈结构所有参与者都可以观测到博弈过去的历史参与者的总支付是所有阶段博弈支付的贴现值之和或加权平均值16、影响重复博弈均衡结果的因素博弈重复的次数当博弈只进行一次时参与者只关心一次性支付但是如果博弈重复多次参与者可能会为了长期利益牺牲眼前利益从而选择不同的均衡策略这是重复博弈给出的一个强有力结果为现实中观测到的许多合作行为和社会规范提供了解释信息的完备性当一个参与者的支付函数特征不为其他参与者所知时该参与者可能有积极性建立一个好声誉换取长远利益如本质不好的人在相当长时间里干好事无限次重复博弈有可能出现合作以牙还牙策略又称为针锋相对策略计算机模拟后发现它是促进合作成功率最高的策略17、合作的必要条件关系要持续在一次性或有限次博弈中决策者是没有合作动机的如火车站的小贩会经常骗人对对方的行为要加以回报一个永远合作的决策者是不会有人跟他合作的如果提高合作性呢要建立稳定的关系工作中形成小组制度要增强识别对方行动的能力如果不清楚对方是合作还是不合作就没办法回报他要维持声誉说要报复就一定要做到人家才知道你是不好欺负的才不敢不与你合作能够分步完成的对局不要一次完成以维持长久关系以促使对方采取合作态度不仅对背叛加以惩罚对合作也要加以回报18、重复博弈与信誉如果博弈重复进行参与者过去行动的历史是可以被观察的重复博弈理论最大的贡献是对人们之间的合作行为提供了理性解释在囚徒困境中一次性博弈的唯一均衡就是不合作如果博弈重复无限次合作就可能会出现这就是旅游景区层出不穷地宰客家门口小店信誉较好实现信誉的条件有可以重复博弈、参与者有足够的耐心、相对确定的环境、欺骗可以被观察到、受骗人可以对欺骗方执行惩罚措施以牙还牙策略是主动出击的也是最能促进合作的一种策略任何参与者的一次性不合作都将触发永远的不合作该策略叫触发策略19、《美德的起源》一书中关于博弈的描述人类是一个高度社会化的物种我们谁也不愿意拱手让出我们的生育权自私的个体怎样才会服从集体的利益博弈论的回答就是奥秘在于双方的多次较量路遥知马力日久见人心就是长期建立合作所关系的最好注解萍聚只能催生不求天长地久但求曾经拥有有人设计了一种叫做“以牙还牙”的计算机程序它的策略是当遇到对手时先摆出友好的合作态度若对方以诚相待则继续合作一个良好的互动关系就此诞生当对方不识好歹则实行报复哪怕双方皆输结果发现这种程序颇有生存优势这种程序提醒我们在一个正常运行的社会中信任是常态从长期较量中建立的合作关系意味着个体必须记住对方的特性、策略随之作出相应的反应甚至有这样的猜测人类的智力起源就与此有关有无穷多种行为规则可以支持合作行为20、不完全信息博弈简介博弈中假设完全信息是所有参与者的共同知识现实中的博弈往往不是完全信息博弈博弈论中的不完全信息是指博弈参与者对其他博弈局势有关的事前信息了解得不充分不完全信息不还完全没有信息否则博弈双方的决策选择就完全失去依据博弈分析变得没有意义至少有一个参与者不知道其他参与者的支付函数的博弈被称为不完全信息博弈又称为贝叶斯博弈在信息不完全的情况下博弈参与者不是使自己的支付或效用最大而是期望效用或收益最大21、注明的BF实验把几只蜜蜂和几只苍蝇放进一个玻璃瓶蜜蜂喜欢光亮在瓶底寻找出口直到累死苍蝇对事物逻辑毫不在意到处乱飞探索有可能出现的任何机会于是它们成功了在这个实验中实验、试错、冒险、迂回前进、混乱、随机应变所有这些有助于应对未知的状况表明要善于打破固定的思维模式要有足够的探索未知领域的学习能力在不完全信息静态博弈中我们追求的实在任何情况下期望效用的最大化而不是一个策略的效用最大化22、纸老虎博弈中国人习惯上将表面强大实质软弱的对手称为纸老虎但是在实际的博弈中对手是不是真正的纸老虎还是一个问题呢对手有可能是纸老虎也有可能是真老虎如果对手其实是真老虎贸然挑战就会招致毁灭性的打击后果是严重的弱小的参与者在面对表面强大的对手时有时候不知道对手是不是真老虎因为信息是不对称的但是战胜纸老虎带来的巨大声誉与遭遇真老虎带来的可怕后果会将弱小者置身于进退两难的境地。弱小的信息错误页时常驱使参与者铤而走险以下为高清排版PDF图片版——方便大家保存