员工绩效考评中的“囚徒困境”模型
员工绩效考评中的“囚徒困境”模型
以下资料由谷唐企业管理咨询有限公司整理提供
在人力资源管理工作中,绩效考评是最关键的一个环节,既是对员工前期工作情况的总
结,也是员工将来薪酬发放、晋级等工作的基础。没有公正、合理的绩效考评,员工的激励、
薪酬等都将成为无源之水、无本之木。所以,绩效考评工作的好坏直接关系到人力资源管理
工作的成效。
员工的工作绩效,是指他们那些经过考评的工作行为、表现及其结果。对组织而言,绩
效就是任务在数量、质量及效率等方面完成的情况;对员工个人来说,则是上级和同事对自
己的评价。组织通过对员工工作绩效的考评,获得反馈信息,便可据此制定相应的人事决策
与措施,调整和改进其效能。
因此绩效考评作为人力资源管理工作的一项重要组成部分,历来受到人力资源工作者的
重视。在绩效考评中,人力资源部门如果能获得员工及员工所在部门提供的真实可靠的原始
资料,绩效考评工作就容易做到公正、合理。
作为人力资源工作者,往往希望员工及用人部门能够和人力资源部门友好合作配合工
作,尽可能提供客观公正的原始资料。但社会的高度现实性决定了绩效考评运作往往直接挂
钩于员工的切身利益,因而,员工倾向于高估自己的工作绩效,以达到个人利益最大化。而
直接上级在对本部门员工的绩效考评上,一则为了和本部门员工保持“友好关系”(因为有
时主管的考评同样需要员工打分);二则为了保持本部门的良好形象,不想“家丑”外扬;
三则为了避免挫伤员工的积极性,使员工永远保持一种优于其它部门的自信,所以更多的喜
欢在本部门内部解决问题,不愿给人力资源部门提供真实的原始数据。
如果缺乏对员工和主管在配合度上的有效监控,很可能会导致绩效考评信息失真,动摇
绩效管理的信度和效度,误导整个人力资源部的绩效管理工作。最终使人力资源部应有的权
力制衡作用受到削减,对企业及员工个人发展产生巨大负面影响。博弈论的出现和兴起,为
我们解决绩效考评中的难题提供了一种行之有效的工具。
一、博弈论中的“囚徒困境”模型与合作剩余分析
所有博弈论书中都有囚徒博弈的例子。他们都有两个选择: 坦白或不坦白,判刑情况
如下表所示。
囚徒A 想, 不管B 怎样, 我坦白最合算。当然, B 也是这么想。结果, 两人都被
判刑8 年。于是乎,两个都后悔万分, 这样还不如都不坦白呢! 刑满释放后, 两人商议,
今后再遇此情况, 一定要都不坦白。后来,两人又犯案被抓。还是面临上述两个选择。结
果, 又是都坦白。呜乎, 又是8 年! 实际上, 他们一点不笨, 任何一个聪明人都是这
样选的。只可惜,聪明反被聪明误!
要解决这一问题, 必须先来观察上述的法则。双方都坦白,两人共坐16 年牢;而都
不坦白,只要共坐2 年牢。两种情况误差14 年,这就是双方都不坦白的共同收益。问题
在于,A不坦白, B要是坦白了, A就更惨了。这的确是问题的关键所在。现在, 既然
知道了最大共同收益的方案, 只需一个有效的保证,使得我们能够实现这一方案,这就需
要合作。我们把合作带来的共同收益称之为合作剩余。合作的有效性在于合作剩余的分配能
够弥补由于不按照最大共同利益原则所得到的收益。上例中,假定坐1 年牢等价于损失1 万
元,只要在协议中规定谁要坦白的话,支付对方3 万元,就可有效避免可怕的困境效应。
有效协议的实质是改变了两者的支付状况。对于上述模型,如果有3 万元的协议保证, 则
支付情况为下表。
显然,此时的双方都会以死不认罪作为自己的选择。此例的目的当然不是鼓励罪犯私通,
以逃避法律的惩罚。目的在于, 提醒经济参与人在博弈的同时,要看清博弈中可能存在的
共同利益。如果有合作剩余存在的话, 那么通过合作以获得额外的合作剩余是最好的方法。
二、绩效考评中的“囚徒困境”模型分析
同样绩效考评本身就是一个完整的博弈论问题,博弈的双方分别是企业的员工和相应的
各部门主管,博弈的对象为员工的工作绩效,而博弈的收益为人力资源部给予的最终考评结
果。
相应的员工和主管所采取的策略不是坦白或不坦白,而是和人力资源部门合作还是不合
作。员工的合作决策指员工愿意和人力资源部门合作,愿意对自己的工作绩效做出客观的评
价;相反,员工的不合作决策指员工隐瞒实情故意做出和实际情况不符的绩效评价(一般情
况是提高自己的工作绩效)。同样,主管的合作决策指主管能够在考核中起表率作用,积极
配合人力资源部门的工作,实事求是对本部门员工的工作绩效做出客观评价;相反,主管的
不合作决策指主管对考核表面上积极配合暗地里却随意应付,使考核数据失真歪曲。
参照“囚徒困境”模型,我们也可以建立一个员工绩效考评中的“囚徒困境”模型。
(一)当员工选择合作决策,同时主管也选择合作决策
此种情况下,人力资源部收集到的原始数据能够比较精确反映现实情况,因此在绩效考
评的操作中可以凭借真实的原始信息,得出和员工实际工作绩效较为吻合的结果。我们姑且
把在这种决策下双方所得计为7个单位效用。
(二)当员工采取合作决策,而主管采取不合作决策
这时人力资源部得到的数据则倾向于以员工提供的材料为主,因此会相应提升员工意见
在考核中的比重,从而考核天平会倾向于员工,即员工可以得到15个单位效用。另外主管
未能有效配合人力资源部的工作,存在失职嫌疑。这将直接影响到主管工作绩效评估,由此
影响主管未来发展,即部门主管能够得到-5个单位效用。
(三)当员工采取不合作决策,而主管采取合作决策
在这种情况下,人力资源部采用的考核数据倾向于主管提供的信息,主管意见在考核中
所占比例大幅度提升。人力资源部认为员工没有基本的敬业精神,作为惩罚,会影响其在本
年度考评周期中的考评结果,即员工此时得到-5个单位效用。而主管积极地配合了人力资
源部的工作,树立了一种可靠、称职的美誉,从而为他赢取了进一步发展的筹码,此种情况
下可以得到15个单位效用。
(四)当员工和主管均采取不合作决策
这是人力资源部最不想看到的局面,因无法收集到必要的真实数据,直接加大了考核工
作的难度,难以保证考核管理的客观公正性,进而影响到绩效考核的整个工作结果。但这是
人力资源部必须履行的一项职责,最终只能在一种无奈的选择中采取折中策略。这种妥协会
使考核结果略高于员工的实际绩效,在短期内员工和部门主管将会得到额外的利益,由此主
管与员工各得到10个单位效用。
参照对"囚徒困境"模型的分析,表格中,每一格里面的第一个数代表员工的支付,第二
个数代表主管的支付。显然,在有限且可预期次数的博弈中,选择不合作对于双方来说都是
最优选择。但是,这一选择对组织来说却是极为不利。因此人力资源部应该致力于使员工与
主管选择合作,这既有利于保证员工和主管的利益,也是人力资源部最愿意看到的。有了真
实的原始数据作参考,保证了绩效考评的效度和信度,才能够使绩效考评发挥应有的激励作
用。
三、从博弈分析中明确实现合作策略的基本要求
从绩效考评的"囚徒困境"模型来分析,要让员工与主管选择合作,必须增加合作选择的
效用或减少不合作选择的效用,从博弈的角度来分析产生合作的必要条件是:1.关系要持续,
一次性的或有限次的博弈中,对策者是没有合作动机的。在实际工作中,由于考核的次数较
多,员工平均就业时间较长,而且员工的离职不可完全预知。因此可以将绩效考评近似看作
无限次重复博弈,这一重复博弈过程可以得到合作解。2.对对方的行为要做出回应。实际上
只要人力资源管理部门能保证绩效考评制度的公正、透明,并且及时、完整的收集员工与主
管的绩效信息,使得员工与主管选择不合作将会带来惩罚,不合作的效用值降低,则员工与
主管的合作策略是可行的。
所以,在绩效考评中,要保证员工与主管选择合作,人力资源部门的相关工作是非常重
要的。
首先,人力资源部门应该负责总体协调,拥有对员工及主管奖惩、培训、晋升等的决定
权。这样既可以保证考评工作由专业人员操作,又可保证奖惩等相关措施能够切实实行。而
且人力资源部门应尽可能把绩效考评正规化,尽量减少考评中的主观性,对主观因素仅用于
工作的改进,而不用于利益挂钩。这样才能使绩效考评更具客观性。
其次,要增强识别员工与主管行动的能力。这就要求人力资源管理部门建立合理的监督
与发现机制,对于员工与主管的行动,要及时发现,了解意图。人力资源部门应定期或不定
期进行相关测试或调查以保持对员工及主管的动态的跟踪,从而获得更多相对准确的信息,
而且需要多渠道收集信息并且还要反复验证信息的准确性、全面性。这样才能使绩效考评的
原始材料更加真实,也使绩效考评更加公平。要注意的是,对员工及主管的考评信息的收集
应同步进行,而且考评的原始资料应作为秘密仅由人力资源部门负责保留,这样既有利于人
力资源部门依据考评资料做出公正的考评,也可以避免员工与主管间可能发生的相互报复。
最后,维持声誉,对于企业来说,明确的规章制度和严格的执行,是维持其制度的首要
条件,这不但保证了企业规章制度的透明性和公开性,也可以使奖惩更加公平。所以人力资
源部门在考评开始前,应该向全体员工公布考评结果的应用范围,要求员工依据考评期的工
作情况如实做出绩效考评,并公布相应的奖惩措施。而考评结束后对合作的员工及主管给与
及时的奖励,而对不合作的则给与严厉的惩罚。合理且有章可循的惩罚,如果在员工的合理
预期之内,并不会造成负面的影响,反而有利于对员工的敦促。
综上所述,一个员工与主管均能合作的绩效考评制度既有利于人力资源部门的人事管理
工作,也有利于激发员工及主管的工作积极性,而且还可以促进双方关系融洽,最终极大推
动组织人力资源管理工作和组织的长远发展。
对囚徒困境的理解
对囚徒困境的理解囚徒困境是博弈论中的一个经典问题,它描述了两个囚徒之间的决策情景。
在这个困境中,两个囚徒被关押在不同的牢房中,他们被指控犯有同样的罪行。
检察官向每个囚徒提供了一个选择:合作还是背叛。
如果两个囚徒都选择合作,即不揭发彼此,那么他们将会被判处较轻的刑罚。
而如果两个囚徒都选择背叛,即相互揭发对方,那么他们将会受到较重的惩罚。
然而,如果一个囚徒选择合作,而另一个囚徒选择背叛,那么背叛的囚徒将会获得最小的刑期,而合作的囚徒将会受到最严厉的惩罚。
这个问题的关键在于,每个囚徒在做出决策时,无法知道对方会选择什么。
因此,每个囚徒都需要权衡自己的选择。
如果他们只考虑个人利益,那么背叛是最理性的选择,因为无论对方选择什么,背叛都能获得较轻的刑罚。
但是,如果两个囚徒都这样选择,那么最终他们都将受到较重的惩罚。
相反,如果每个囚徒考虑到对方的选择,那么合作就成为了最优策略。
因为如果两个囚徒都选择合作,他们都能够获得较轻的刑罚。
而如果一个囚徒选择背叛,那么他将面临较重的刑罚,而另一个囚徒的选择将不会对他造成任何影响。
囚徒困境的核心在于协作与背叛之间的冲突。
每个囚徒都有动机追求自己的利益,但如果他们只顾自己,最终结果可能是对双方都不利的。
只有通过相互合作,才能够达到双方的最佳结果。
囚徒困境不仅仅是一个理论问题,它在现实生活中也有很多应用。
例如,在商业谈判中,各方之间存在着合作与背叛的选择。
如果每个人只追求自己的利益,那么谈判可能会陷入僵局。
但如果各方能够相互信任、相互合作,那么谈判可能会达成双赢的结果。
在囚徒困境中,合作是一种理性的选择。
虽然背叛可能会在短期内带来一些好处,但从长远来看,合作才能够带来最大的利益。
通过合作,囚徒可以减轻自己的刑罚,并且为对方也创造了一个减轻刑罚的机会。
囚徒困境还提醒我们,相互信任和合作是社会发展的重要基石。
如果每个人都只考虑自己的利益,那么整个社会可能陷入恶性循环。
只有通过相互信任和合作,才能够实现社会的和谐与进步。
“囚徒困境”引发的思考经济学理论论文
“囚徒困境”引发的思考经济学理论论文囚徒困境”博弈是图克(Tucker)1950年提出的一个著名的博弈模型,是完全信息静态博弈的典型例子。
一、基本模型囚徒困境博弈的基本情况如下:警察抓住了两个合伙犯罪的罪犯,但却缺乏足够的证据指证他们所犯的罪行。
如果其中至少有一人供认犯罪,就能确认罪名成立。
为了得到所需的口供,警察将这两名罪犯分别关押以防止他们串供或结成攻守同盟,并给他们同样的选择机会;如果他们两人都拒不认罪,则他们会被以较轻的妨碍公务罪各判1年徒刑;如果两人中有一人坦白认罪,则坦白者从轻认罪,立即释放,而另一人则将重判8年徒刑;如果两人同时坦白认罪,则他们将被各判5年监禁。
如果分别用-1、-5和-8 表示罪犯被判刑1年、5年和8年的得益,用0表示罪犯被立即释放的得益,则两囚徒的得益矩阵如下:囚徒2坦白不坦白囚徒1 坦白-5,-5 0,-8不坦白-8,0 -1,-1在上图中,“囚徒1”、“囚徒2”分别代表本博弈中的两个博弈方,也就是两个罪犯;他们各自都有“不坦白”和“坦白”两种可选择的策略;因为这两个囚徒被隔离开,其中任何一人在选择策略时都不可能知道另一人的选择是什么,因此不管他们决策的时间是否真正相同,我们都可以把他们的决策看作是同时做出的。
其中矩阵中第一个数字代表决策结果后囚徒1的得益,第二个数字代表决策结果后囚徒2的得益。
博弈的结果是:由于这两个囚徒之间不能串通,并且各人都追求自己的最大利益而不会顾及同伙的利益,双方又都不敢相信或者说指望对方有合作精神,因此只能实现对他们都不理想的结果(各判5年),并且这个结果具有必然性,很难摆脱,因此这个博弈被称为“囚徒困境”。
[1]二、关于完全理性的思考囚徒困境博弈的一个假设是博弈方都是完全理性。
完全理性来源于经济学中的理性人假设,即博弈方都以个体利益最大化为目标,且有准确的判断选择能力,也不会“犯错误”。
以个体利益最大为目标被称为“个体理性”,有完美的分析判断能力和不会犯选择行为的错误称为“完全理性”。
囚徒困境经济学原理
囚徒困境经济学原理引言:囚徒困境是博弈论中一个经典的问题,也是经济学中的重要原理之一。
囚徒困境的情境是两个囚徒被捕后被分开审讯,检方没有足够的证据定罪,但却希望能定罪并判刑。
如果两个囚徒都保持沉默,则检方只能以轻罪定罪。
然而,如果其中一个囚徒选择合作并供出另一个囚徒,那么供出者将获得免罪的机会,而被供出者将面临重刑。
如果两个囚徒都选择供出对方,则两人都将面临有限的刑期。
囚徒困境问题展示了个人理性行为在博弈过程中可能导致的不利结果,对经济学有着重要的启示意义。
1.囚徒困境的基本情景囚徒困境的基本情景是两个囚徒在被捕后被审讯,他们面临着个人决策的困难。
在这个情境中,囚徒可以选择合作或背叛对方。
合作意味着保持沉默,而背叛意味着供出对方。
囚徒的决策将决定他们的命运,而他们并不知道对方的选择。
在这种情况下,囚徒需要权衡自己的利益和对方的选择来做出决策。
2.囚徒困境的策略和收益在囚徒困境中,每个囚徒都有两种策略可选择:合作或背叛。
合作的收益是较低的刑期,而背叛的收益是免罪。
然而,如果两个囚徒都选择背叛,那么他们都将面临较长的刑期。
因此,囚徒困境的最佳策略是背叛,因为无论对方选择什么,背叛都能获得更好的结果。
3.囚徒困境的启示意义囚徒困境问题揭示了个人理性行为可能导致不利结果的情况。
尽管合作对于整体利益是最好的选择,但个人追求自身利益往往会导致困境的产生。
囚徒困境的启示意义在于,个体之间的合作需要建立在互信和合作机制的基础上,才能避免困境的发生。
4.囚徒困境与经济学的关系囚徒困境经济学原理在经济学领域有着广泛的应用。
例如,在市场竞争中,企业可能面临类似的囚徒困境。
如果所有企业都选择合作并遵守竞争规则,市场将保持公平竞争的状态。
然而,如果有企业选择背叛并采取不正当手段获取竞争优势,其他企业也会被迫采取同样的策略,从而导致整个市场的恶性竞争。
囚徒困境经济学原理提醒我们,建立公平竞争的机制和规则对于市场的稳定和发展至关重要。
囚徒困境
随着年龄的增长,你是做领导呢?还是一直从事基层的劳动?
过渡页
第 55 页
为什么需要时间管理
时间与时间管理概述
时间管理的基本原理
时间管理的具体实施
4.1.1 事项清单的来源
每天上班第一件事,罗列“待完成”事项清单。
① 事 项 清 单
月/周目标的分解或计划的安排 各种临时插单/紧急任务 已经预约的安排 各种未完成事项(历史累积)
如何才能改变 利益大小?
如何走出囚徒困境
订合同 报复与惩罚(株连制) 长期关系和重复博弈 坦白 无期徒刑,无期 徒刑 死刑, 无罪释放+100万 /父母子女人质/ 长期利益 无罪释放+100万/父母子女 人质/长期利益 ,死刑 有期一年,有期一年 坦白 Nhomakorabea李四
抵赖
张三
抵赖
总结
理性选择造成次优结果 打破囚徒困境的方法是改变收益
便宜 实惠 同样的钱,买的最多
原理图示
效益
效能
效率
勤恳
① 基 本 原 理
效益 (Benefit) 效果与利益,是 最终追求的结果
效能 (Effectiveness) 强调目的正确、 效果有利
效率(Efficiency) 是指在单位时间 里完成的工作量
勤恳 (Diligence) 充分利用时间, 不浪费
效能最为重要,效率次之,勤恳再次之。
重要
关注“效能”,即——
要事第一
紧急
如何判断要事?请将您的事项填入左图模型。
您认为这四个象限做事的顺序该是怎样的? 您平时每天都在做哪个象限的事情呢?
② 效 能
由此,您是怎样的工作状态?
囚徒困境-囚徒困境完美版资料
• 假设,甲、乙经营条件一样,在销售价格一样的情况下销 售量一样为q,另一方面消费者在调查甲、乙销售价格后, 会选择向价格低的一方购买。案例模型如下:
•
• 同样的道理,为了保 住市场份额,获得更 囚徒困境是博弈论的非零和博弈中具代表性的列子。
卷烟价格竞争是一场博弈,诸多卷烟零售户都是这场博弈的参与者,诸多参与者的博弈又可以分解缩写为两两的博弈。
选择1元的毛利,分别 反映了个人最佳选择并非集体最佳选择。
虽然困境本身只属模型性质,但现实中的价格竞争·环境保护等方面会频繁出现类似情况。
获利q元,市场达到均 虽然困境本身只属模型性质,但现实中的价格竞争·环境保护等方面会频繁出现类似情况。
在此笔者试图在甲、乙两位零售户间,针对目前畅销的阿龙牌香烟定价建立博弈模型。
囚徒困境是博弈论的非零和博弈中具代表性的 列子。反映了个人最佳选择并非集体最佳选择。 虽然困境本身只属模型性质,但现实中的价格
竞争·环境保护等方面会频繁出现类似情多卷烟零售 户都是这场博弈的参 与者,诸多参与者的 博弈又可以分解缩写 为两两的博弈。在此 笔者试图在甲、乙两 位零售户间,针对目 前畅销的阿龙牌香烟 定价建立博弈模型。
衡,阿龙牌香烟的价 律,可以说是市场的选择,但结果却与甲和乙“利己”的初衷恰恰相反,没有达到集体利益的最大化,即帕累托最优。 格就是(成本c+毛利q) 元
反映了个人最佳选择并非集体最佳选择。 虽然困境本身只属模型性质,但现实中的价格竞争·环境保护等方面会频繁出现类似情况。 虽然困境本身只属模型性质,但现实中的价格竞争·环境保护等方面会频繁出现类似情况。 囚徒困境是博弈论的非零和博弈中具代表性的列子。 律,可以说是市场的选择,但结果却与甲和乙“利己”的初衷恰恰相反,没有达到集体利益的最大化,即帕累托最优。 虽然困境本身只属模型性质,但现实中的价格竞争·环境保护等方面会频繁出现类似情况。 反映了个人最佳选择并非集体最佳选择。 囚徒困境是博弈论的非零和博弈中具代表性的列子。 律,可以说是市场的选择,但结果却与甲和乙“利己”的初衷恰恰相反,没有达到集体利益的最大化,即帕累托最优。 卷烟价格竞争是一场博弈,诸多卷烟零售户都是这场博弈的参与者,诸多参与者的博弈又可以分解缩写为两两的博弈。 反映了个人最佳选择并非集体最佳选择。 律,可以说是市场的选择,但结果却与甲和乙“利己”的初衷恰恰相反,没有达到集体利益的最大化,即帕累托最优。 虽然困境本身只属模型性质,但现实中的价格竞争·环境保护等方面会频繁出现类似情况。 卷烟价格竞争是一场博弈,诸多卷烟零售户都是这场博弈的参与者,诸多参与者的博弈又可以分解缩写为两两的博弈。 反映了个人最佳选择并非集体最佳选择。
员工绩效差在哪?用冰山分析法就知道
员工绩效差在哪?用冰山分析法就知道来源| 《培训》杂志1月刊作者| 高海军在真实的工作场景中,并不是所有问题都有非常明确的方案。
更常见的情况是,当我们接手新工作时,有可能面对的是某种乱局,很多事务会纠缠在一起,然而,领导仅告诉你要尽快解决这些问题,至多再给你定个笼统的大目标。
接下来,你要最先从哪个问题入手,解开这一堆乱麻?这时候,聚焦关键问题就非常有价值,一旦找到它,对症下药,这团乱麻就可以一点点解开了;否则,只会越解越紧,最终变成死结。
把握理论区分原因诸多存在因果关系的现象之间,如果一种现象是其他多种现象的“因”,我们就认为它更趋向于根本原因;反之,则更趋向于表面原因。
冰山分析法,就是一个寻找绩效差距根本原因的工具。
?有因才有果“物有本末,事有始终。
知所先后,则近道矣。
”一种现象的变化会引起另一种现象的变化,则表明这两种现象存在因果关系。
对于因果关系,苏格兰哲学家大卫·休谟(David Hume)曾对此进行过剖析。
他认为,所谓因果,有三层含义:第一,是原因和结果事件之间在时空上毗连(contiguity),时空联接是因果关系的先决条件。
如果两个时空相距很远的物体产生了因果作用,那么其间必然存在某种因果链条的衔接。
第二,是时间顺序(succession),先因后果。
第三,是必然联系(necessary connection),即因果现象相伴而生,有因必有果。
?三大原因标本兼治参照冰山模型,可以将原因分为表面原因、过渡原因和根本原因三大类,并针对不同原因,采取差异化策略,以求达到标本兼治的效果。
表面原因正如冰山露出水面的部分,表面原因是人们可以看到的现象,也是直接造成问题的原因。
比如,有人感冒后发烧,也有人感冒不发烧,而是伤口感染发炎导致发烧。
其中,发烧就是一种现象,属于表面原因。
当然,我们需要分析“发烧”背后的真正原因。
过渡原因根据冰山模型,过渡原因虽然在水面以下,不可能直接观察到,但实际上,它并非造成问题的根本原因。
囚徒困境的例子
囚徒困境(prisoner's dilemma)是指两个被捕的囚徒之间的一种特殊博弈,说明为什么甚至在合作对双方都有利时,保持合作也是困难的。
囚徒困境是博弈论的非零和博弈中具代表性的例子,反映个人最佳选择并非团体最佳选择。
虽然困境本身只属模型性质,但现实中的价格竞争、环境保护、人际关系等方面,也会频繁出现类似情况。
例子:北大清华的状元之争是一个典型的囚徒困境。
囚徒困境是社会合作面临的最大难题,它深刻揭示了个体理性和集体理性之间的矛盾和冲突:个体按照自身利益最大化的原则采取对自己最有利的占优战略,得到的却不一定是自己最想要的结果,相反可能导致集体的非理性。
就生源竞争而言,对于北大来说,无论清华抢不抢状元,抢状元都是北大的最好选择,即最优战略;对于清华来说也是一样。
用博弈论的专业术语来表述,(抢状元,抢状元)构成了北大清华招生博弈的纳什均衡。
纳什均衡是一个僵局,给定对手不改变行为,自己就没有激励改变行为,因而无法打破或单独偏离均衡。
纳什均衡最深刻的悲剧性在于,北大和清华都意识到抢状元是毫无意义的,但抢状元却是他们必然的选择。
即使两所大学都认同不抢状元是最好的,但这个结果却得不到,因为每所大学都不得不采取对自己最有利的行动——抢状元。
除非引入第三方力量改变博弈结构,否则囚徒困境就不可能被打破。
扩展资料相关应用:封闭交易霍夫施塔特曾提出,像囚徒困境一类的问题,若以简单博弈的形式来说明,人们会较容易理解。
例如他以“封闭袋子交易”的简单博弈来说明此论题:两人面对面互相交换封闭的袋子,共同了解其中一方放钱,另一方放商品。
双方可以诚实的依照承诺,把东西放到袋子里交换;又或者交空袋子给对方,选择背叛。
在这场博弈中,由于背叛可获得巨大利益,必然有多人选择背叛。
这意味着理性的商人不会进行这种交易,因而“封闭袋子交易”将由于逆向选择而失去市场。
囚徒困境
思考题:什么是囚徒困境?谈谈你 什么是囚徒困境? 什么是囚徒困境 的分析和认识. 的分析和认识.
参考读物
Campbell,R.,and L. Sowden, eds.(1985). Paradox of Rationality and Cooperation Prisoner's Dilemma and Newcomb's Problem. Vancouver: The University of British Columbia Press. 罗伯特艾克斯罗德:《合作的进化》,上海人 民出版社,1996年版 周骏宇:"艾克斯罗德重复博奕实验及其应 用",《自然辩证法研究》2005年第3期
囚徒困境的原因和性质
是否由于"通讯"问题造成了囚徒困境? "要害"是否在于"利己主义"? 原因和性质:个人理性和集体理性的矛 盾;个人的"最优策略"使整个"系统" 处于不利的状态 囚徒困境的效果在不同情况下对社会而 言可能是"负面"的,也可能是"正面" 的
解决囚徒困境问题的"出路"
(1)"解决个人理性和集体理性之间冲 突的办法不是否认个人理性,而是设计 一种机制,在满足个人理性的前提下达 到集体理性";"一种制度安排,要发 生效力,必须是一种纳什均衡.否则, 这种制度安排便不能成立" (2)引入惩戒机制后引起的新博奕问题
4,不要耍小聪明; (在比赛中许多"程序"出现的问题是使用一 些复杂的方法来推断对方,而这些推断常常是 错误的.) 零和博奕(如下棋)和非零和博奕(如"重复 的囚徒困境")有一些重要的不同.在下棋时 让你的对手猜疑你的企图是有用的,在"重复 的囚徒困境"中,你要从对手的合作中得到好 处,诀窍在于鼓励合作,一个好的方式就是清 楚表明你愿意合作
博弈论中经典案例--“囚徒困境”
博弈论中经典案例--“囚徒困境”博弈论中有一个经典案例--“囚徒困境”。
两个共谋犯罪的人被关入监狱,不能互相沟通情况。
如果两个人都不揭发对方,则由于证据不确定,每个人都坐牢一年;若一人揭发,而另一人沉默,则揭发者因为立功而立即获释,沉默者因不合作而入狱十年;若互相揭发,则因证据确实,二者都判刑八年。
由于囚徒无法信任对方,因此倾向于互相揭发,而不是同守沉默。
囚犯可以做出如下选择:1、供出他的同伙(即与警察合作,从而背叛他的同伙),2、保持沉默(也就是与他的同伙合作,而不是与警察合作)。
这两个囚犯都知道,如果他俩都能保持沉默的话,就都会被释放,因为只要他们拒不承认,警方无法给他们定罪。
但警方也明白这一点,所以他们就给了这两个囚犯一点儿刺激:如果他们中的一个人背叛,即告发他的同伙,那么他就可以被无罪释放,同时还可以得到一笔奖金。
而他的同伙就会被按照最重的罪来判决,并且为了加重惩罚,还要对他施以罚款,作为对告发者的奖赏。
当然,如果这两个囚犯互相背叛的话,两个人都会被按照最重的罪来判决,谁也不会得到奖赏。
那么,这两个囚犯该怎么办呢?是选择互相合作还是互相背叛?从表面上看,他们应该互相合作,保持沉默,因为这样他们俩都能得到最好的结果:自由。
但他们不得不仔细考虑对方可能采取什么选择。
A犯不是个傻子,他马上意识到,他根本无法相信他的同伙不会向警方提供对他不利的证据,然后带着一笔丰厚的奖赏出狱而去,让他独自坐牢。
这种想法的诱惑力实在太大了。
但他也意识到,他的同伙也不是傻子,也会这样来设想他。
所以A犯的结论是,唯一理性的选择就是背叛同伙,把一切都告诉警方,因为如果他的同伙笨得只会保持沉默,那么他就会是那个带奖出狱的幸运者了。
而如果他的同伙也根据这个逻辑向警方交代了,那么,A犯反正也得服刑,起码他不必在这之上再被罚款。
所以其结果就是,这两个囚犯按照不顾一切的逻辑得到了最糟糕的报应:坐牢。
囚徒困境模型的几个现实例子囚徒困境的例子在现实生活中很多。
囚徒效应
囚徒效应1、百科名片囚徒困境是博弈论的非零和博弈中具代表性的例子,反映个人最佳选择并非团体最佳选择。
虽然困境本身只属模型性质,但现实中的价格竞争、环境保护等方面,也会频繁出现类似情况。
2、概念释义囚徒困境(prisoner's dilemma ):两个被捕的囚徒之间的一种特殊博弈,说明为什么甚至在合作对双方都有利时,保持合作也是困难的。
(源自曼昆《经济学原理》第五版,北京大学出版社)单次和多次重单次发生的囚徒困境,和多次重复的囚徒困境结果不会一样。
在重复的囚徒困境中,博弈被反复地进行。
因而每个参与者都有机会去“惩罚”另一个参与者前一回合的不合作行为。
这时,合作可能会作为均衡的结果出现。
欺骗的动机这时可能被受到惩罚的威胁所克服,从而可能导向一个较好的、合作的结果。
作为反复接近无限的数量,纳什均衡趋向于帕累托最优。
囚徒困境的主旨囚徒们虽然彼此合作,坚不吐实,可为全体带来最佳利益(无罪开释),但在资讯不明的情况下,因为出卖同伙可为自己带来利益(缩短刑期),也因为同伙把自己招出来可为他带来利益,因此彼此出卖虽违反最佳共同利益,反而是自己最大利益所在。
但实际上,执法机构不可能设立如此情境来诱使所有囚徒招供,因为囚徒们必须考虑刑期以外之因素(出卖同伙会受到报复等),而无法完全以执法者所设立之利益(刑期)作考量。
固定局数的囚徒困境试想像囚徒困境的情况进行十次。
我们可以合理地设想,如果囚徒第一次被对方指控,第二次这个囚徒也会指控对方。
相反,如果第一次别人保持沉默,建立了互信的关系,你也会保持沉默,达致帕累托最优。
当然,两个囚徒都会有相似的想法,在第一局保持沉默,以期望建立互信关系,所以双方都会保持沉默。
第二局时,双方亦应有相似的想法,继续保持沉默,以期继续在互信的情况下进行第三局,以致余下的八局。
这种想法合理吗?在第十局时,互信的关系明显是没有意义的,因为十局已经完结,囚徒没有必要为维持互信的关系而沉默(没有第十一局),所以第十局囚徒一定会背叛对方的,理由和只有一局囚徒困境一样。
