有关“囚徒困境”的研究

有关“囚徒困境”的研究

ID:27266170

大小:110.00 KB

页数:18页

时间:2018-12-02

有关“囚徒困境”的研究_第1页
有关“囚徒困境”的研究_第2页
有关“囚徒困境”的研究_第3页
有关“囚徒困境”的研究_第4页
有关“囚徒困境”的研究_第5页
资源描述:

《有关“囚徒困境”的研究》由会员上传分享,免费在线阅读,更多相关内容在教育资源-天天文库

1、研究性学习结题报告:-17-有关“囚徒困境”的研究组长:组员:指导老师:主导科目:政治研究目的:通过研究“囚徒困境”,了解形成囚徒困境的原因、走出囚徒困境的方法和利用囚徒困境解决生活问题。研究目标:了解囚徒困境,囚徒效应。研究意义:利用囚徒困境解决各个领域的问题。研究内容:囚徒困境、囚徒效应、博弈、社会心理学。研究方法:1、从网上图书馆查找有关资料2、把收集到的资料、故事等加以综合分析,并加以整理3、听有关专家报告4、走访有关心理专家5、参加社会调查(教育、市场经济、军事、刑侦等)研究思路:1、研究《博弈学习理论》(【美】朱·弗登伯格、戴维·K·莱文著)《社会心理学》(沙莲香著)2、进行调查研

2、究3、综合分析并整理研究时间:2009年7月13日~8月25日活动计划:7月13日至15日讨论研究内容、拟定实施方案、人员分工7月16日至31日学习研究《博弈学习理论》及《社会心理学》8月1日至3日从网上图书馆查找有关资料8月4日至6日听有关专家报告8月7日至9日走访有关心理专家8月10日至18日参加社会调查8月19日至25日综合分析整理资料、完结报告-17-囚徒困境的理论研究第一部分:什么是囚徒困境(prisoner'sdilemma)一、囚徒困境(prisoner'sdilemma)是博弈论的非零和博弈中具代表性的例子,反映个人最佳选择并非团体最佳选择。虽然困境本身只属模型性质,但现实中的

3、价格竞争、环境保护等方面,也会频繁出现类似情况。  单次发生的囚徒困境,和多次重复的囚徒困境结果不会一样。  在重复的囚徒困境中,博弈被反复地进行。因而每个参与者都有机会去“惩罚”另一个参与者前一回合的不合作行为。这时,合作可能会作为均衡的结果出现。欺骗的动机这时可能被受到惩罚的威胁所克服,从而可能导向一个较好的、合作的结果。作为反复接近无限的数量,纳什均衡趋向于帕累托最优。  囚徒困境的主旨为,囚徒们虽然彼此合作,坚不吐实,可为全体带来最佳利益(无罪开释),但在资讯不明的情况下,因为出卖同伙可为自己带来利益(缩短刑期),也因为同伙把自己招出来可为他带来利益,因此彼此出卖虽违反最佳共同利益,反

4、而是自己最大利益所在。但实际上,执法机构不可能设立如此情境来诱使所有囚徒招供,因为囚徒们必须考虑刑期以外之因素(出卖同伙会受到报复等),而无法完全以执法者所设立之利益(刑期)作考量。二、经典的囚徒困境  1950年,由就职于兰德公司的梅里尔·弗勒德(MerrillFlood)和梅尔文·德雷希尔(MelvinDresher)拟定出相关困境的理论,后来由顾问艾伯特·塔克(AlbertTucker)以囚徒方式阐述,并命名为“囚徒困境”。经典的囚徒困境如下:  警方逮捕甲、乙两名嫌疑犯,但没有足够证据指控二人入罪。于是警方分开囚禁嫌疑犯,分别和二人见面,并向双方提供以下相同的选择:  若一人认罪并作证

5、检控对方(相关术语称“背叛”对方),而对方保持沉默,此人将即时获释,沉默者将判监10年。  若二人都保持沉默(相关术语称互相“合作”),则二人同样判监半年。  若二人都互相检举(互相“背叛”),则二人同样判监2年。  用表格概述如下:-17-  甲沉默(合作)甲认罪(背叛)  乙沉默(合作)二人同服刑半年甲即时获释;乙服刑10年  乙认罪(背叛)甲服刑10年;乙即时获释二人同服刑2年  解说  如同博弈论的其它例证,囚徒困境假定每个参与者(即“囚徒”)都是利己的,即都寻求最大自身利益,而不关心另一参与者的利益。参与者某一策略所得利益,如果在任何情况下都比其他策略要低的话,此策略称为“严格劣势”

6、,理性的参与者绝不会选择。另外,没有任何其他力量干预个人决策,参与者可完全按照自己意愿选择策略。  囚徒到底应该选择哪一项策略,才能将自己个人的刑期缩至最短?两名囚徒由于隔绝监禁,并不知道对方选择;而即使他们能交谈,还是未必能够尽信对方不会反口。就个人的理性选择而言,检举背叛对方所得刑期,总比沉默要来得低。试设想困境中两名理性囚徒会如何作出选择:  若对方沉默、背叛会让我获释,所以会选择背叛。  若对方背叛指控我,我也要指控对方才能得到较低的刑期,所以也是会选择背叛。  二人面对的情况一样,所以二人的理性思考都会得出相同的结论——选择背叛。背叛是两种策略之中的支配性策略。因此,这场博弈中唯一可

7、能达到的纳什均衡,就是双方参与者都背叛对方,结果二人同样服刑2年。  这场博弈的纳什均衡,显然不是顾及团体利益的帕累托最优解决方案。以全体利益而言,如果两个参与者都合作保持沉默,两人都只会被判刑半年,总体利益更高,结果也比两人背叛对方、判刑2年的情况较佳。但根据以上假设,二人均为理性的个人,且只追求自己个人利益。均衡状况会是两个囚徒都选择背叛,结果二人判决均比合作为高,总体利益较合作为低。这就是“

当前文档最多预览五页,下载文档查看全文

此文档下载收益归作者所有

当前文档最多预览五页,下载文档查看全文
温馨提示:
1. 部分包含数学公式或PPT动画的文件,查看预览时可能会显示错乱或异常,文件下载后无此问题,请放心下载。
2. 本文档由用户上传,版权归属用户,天天文库负责整理代发布。如果您对本文档版权有争议请及时联系客服。
3. 下载前请仔细阅读文档内容,确认文档内容符合您的需求后进行下载,若出现内容与标题不符可向本站投诉处理。
4. 下载文档时可能由于网络波动等原因无法下载或下载错误,付费完成后未能成功下载的用户请联系客服处理。