首页学术期刊 博弈论的国内研究现状论文

博弈论的国内研究现状论文

博弈论的国内研究现状论文论文国内外的研究现状论文国内外现状研究现状

心晴joanny 2023-12-05 17:34:09

共3条回答208浏览

狮城*青云

2小时前发布
- 博弈论及其在现代经济生活中的应用有一个典型的案例：甲乙两人合伙作案，结果被警察抓了起来，分别被隔离审讯。在不能互通信息的情形下———也就是不知道对方是坦白还是缄默的前提下，每个嫌疑犯都可以作出自己的选择：或者供出同伙，即与警察合作，从而背叛同伙；或者保持沉默，也就是与同伙合作，而不是与警察合作。这样会出现以下几种情况：如果两人都不坦白，警察会因证据不足而将两人各判刑! 年；如果一人招供而另外一人不招，坦白者作为证人将不会被起诉，另一人将会被重判!" 年；如果两人都招供，则会因罪名成立各判!# 年。这两个嫌疑犯该怎么办呢？是选择合作还是互相背叛？从表面上看，他们应该互相合作，保持沉默，因为这样对他们整体而言是最好的结果———都只判!年。但是他们不得不仔细考虑对方可能采取的选择。问题就这样开始了，两个人都十分精明，而且只关心减少自己的刑期，并不会在乎对方被判多少年。每个人都会这样推理：假如对方不招，我只要一招供，马上可以获得自由，而不招却要坐牢! 年，显然招比不招好；假如对方招了，我若不招，则要坐牢!" 年。招了只要坐牢!# 年，显然还是招更好些。可见，对方无论招或者不招，我的最佳选择都是招认。两个人都会基于同样的想法作出招供的选择，这对他们个人来说都是最佳策略，但对整体而言却是一个最差的结果。这就是博弈论的一个经典模型———“囚徒困境模型”。作为一种关于决策和策略的理论，博弈论其实就在我们身边，它研究的许多例子来自于日常生活和经济活动中的游戏和事物。博弈的英文即，中文译为“博弈”是非常传神和贴切的，因为中国古代称下棋为“弈”，“博”则含有争斗的意思。在下棋这样的游戏中有一个重要的特点：即策略在其中起着举足轻重的影响和作用。精明慎重的棋手们相互揣摩、相互牵制，人人争赢，布每一个棋子时，都必须考虑到对手的策略选择，从而选择自己的最佳策略。这也就是博弈的核心问题：决策主体的一方行动后，参与博弈的其他人将会采取什么行动？参与人为取得最佳效果应采取怎样的对策？我们可以将博弈论定义为：一些个人、一些团队或其他组织，面对一定的环境条件，在一定的规则约束下，依靠所掌握的信息，同时或先后，一次或多次，从各自允许选择的行为或策略进行选择并加以实施，并从中各自取得相应结果或收益的过程。博弈论是(# 世纪四五十年代发展起来的。美国经济学家冯•诺依曼与奥斯卡•摩根斯特恩于!)**年合著的《博弈论与经济行为》被公认为博弈论诞生的标志。博弈论可以分为合作博弈理论和非合作博弈理论。前者主要强调的是集体理性；而后者主要研究人们在利益相互影响的局势中如何选择策略使自己的收益最大，强调的是个人理性。所谓“个人理性”是反映个体的行为始终都是以实现自身的最大利益为惟一目标，除非是为了实现自身利益的需要，否则不会考虑其他的个体或社会利益这样一种决策原则。非合作博弈要求各参与人之间不能存在任何有约束力的协议，也就是各个参与人不能公开“串通”或“共谋”。(# 世纪"# 年代，数学家纳什提出了著名的非合作博弈的纳什均衡理论，奠定了现代非合作博弈论的基石，后来的博弈论研究基本上是沿着这条主线展开的。纳什均衡理论地提出和不断完善为博弈论广泛应用于经济学、管理学、社会学、政治学、军事科学等领域奠定了坚实的理论基础。现在人们所说的博弈论基本是指非合作博弈论。这是因为竞争是一切社会经济关系的根本基础。在现实生活中非合作的情况要比合作普遍，不合作是基本的，合作是有条件和暂时的。事实上在我们证明非合作博弈的无效率或低效率的同时，就自然说明了博弈论及其在现代经济生活中的应用!# 杨佳佳!"存在着合作的可能性和必要性。“囚徒困境模型”在现代经济生活中有着广泛而深刻的应用。比如，我们经常会遇到各种各样的价格大战，家用电器大战、服装大战、机票打折大战⋯⋯。按照囚徒困境模型，各个厂家都将选择降价作为自己的优势策略。因为别的厂家如果不降价，我选择降价将会获得更多的市场份额；别的厂家如果降价，我只有跟着降价才能维持本来的市场份额。最后，博弈的结果是各个厂家谁都没有多少钱赚。再如，在遗失钱物时，遗失人和拾得人的心态其实也就像这两个囚徒，前者希望不给任何报酬能失而复得，后者怕得不到报答干脆占为己有，博弈的结果通常是遗失物被拾得人侵占。“囚徒困境博弈”准确地抓住了人性的真实一面———相互防范背叛与彼此的不信任，以及这种心理对合作的破坏作用。但是，在现实生活中，我们巴不得囚徒之间以及各个厂家之间不能合作。因为我们不愿意看到危险的罪犯通过合作逃脱了法律的制裁或者是几个大企业联合起来形成对行业的垄断，导致我们不能享受合理的价格。在现实生活中，我们也期待遗失人和拾得人能更多地为对方的利益着想，从而提升整个社会的道德水准。当我们试图阻挠或者促进“囚徒”之间的合谋，希望通过法律或者道德维系良好的社会秩序时，我们必须了解什么样的途径可以破解“囚徒困境”，并且正视人们正当的逐利心态在博弈过程中的影响。比如：很多发达国家往往利用法律的形式对垄断行为进行严格的限制。反垄断法的实施阻挠了企业之间的价格合谋，并且激励企业改善管理，开发技术，努力以较低的成本生产质量较好的产品，提高企业的市场竞争力。同时，如果我们期待拾金不昧的博弈结果，那么就要鼓励归还失物这一善行。怎么鼓励呢？中国人的道德宗师孔子两千年前就回答了这个问题。孔子的弟子有一次救了一个溺水的人。被救者酬谢这位弟子一头牛，他收下了。孔子对这个弟子的行为大加赞赏。因为这会激励更多的人去救人，今后也会有更多溺水的人得到营救。道德准则要求人们不要惟利是图，但是从不反对社会成员通过自己的正当行为获取收益。如果德行善举得不到报答和补偿，那么它就只能是少数圣贤的“专利”而不会成为社会公德。“智猪博弈模型”是博弈论中另一个经典的模型。它说的是：猪圈里有两头猪，一头大猪，一头小猪。猪圈的一边有个踏板，每踩一下踏板，在远离踏板猪圈的另一边的投食口就会落下少量的食物。如果有一只猪去踩踏板，另一只猪就有机会抢先吃到另一边落下的食物。当小猪踩动踏板时，大猪会在小猪跑到投食口之前刚好吃完所有的食物；若是大猪踩动了踏板，则还有机会在小猪吃完落下的食物之前跑到投食口，争吃到另一半残羹。那么，两只猪各会采取什么策略？答案是小猪将选择“搭便车”策略，也就是舒舒服服地等在投食口旁；而大猪则为一点残羹不知疲倦地奔忙于踏板和投食口之间。原因何在？因为，小猪踩踏板将会一无所获，不踩踏板反而能吃上食物。对小猪而言，无论大猪是否踩动踏板，不踩踏板总是最好的选择。反观大猪，已经明知小猪是不会踩动踏板的，自己踩总比不踩强，所以，只好亲历亲为了。这个经典模型揭示了市场竞争中大企业与小企业之间的关系。研究开发，为新产品做广告，对大企业是值得的，对小企业则得不偿失。小企业应把精力花在模仿上，或等待大企业用广告打开市场后出售廉价产品，而大企业应当以主动的态度来开拓市场。一个理性的企业，就应该象“智猪”一样，选择自己的优势策略。在欧佩克中，各个成员的生产能力各不相同。同属一个同盟的大成员和小成员，他们应该选择遵守协议还是选择作弊多生产石油呢？假设以沙特阿拉伯和科威特为例。假定在合作的情况下，科威特每天应当生产!"" 万桶石油，沙特阿拉伯则生产#"" 万桶。对于他们两家而言，作弊意味着每天多生产!"" 万桶。科威特有一个优势策略：作弊每天生产$"" 万桶。沙特阿拉伯的优势策略则是遵守协议，每天仍然生产#"" 万桶。为什么会这样呢？沙特阿拉伯选择遵守协议也是出于纯粹的自利心理。假如它有一个较低的生产数量，则市场价格攀升，欧佩克全体成员的边际利润上扬。如果它的产量只占欧佩克总产量一个很小的份额，它自然很难发现价格上扬对自己的好处。如果它占的份额很大，他将占有上扬的边际利润的大部分好处，因此牺牲一些产量也是值得的。智猪博弈模型给了竞争中的弱者（小猪）最佳策略的启发。但是对于社会而言，由于小猪未能参加竞争，小猪搭便车式的社会资源配置并不是最佳状态。为使资源有效配置，避免“小猪躺着大猪跑”的现象，游戏规则的设计就非常关键了。规则的核心指标是：每次落下的食物数量和踏板与投食口之间的距离。如果改变核心指标，会出现什么样的现象呢？改变方案一：减量方案。投食仅是原来的一半分量。结果是大猪和小猪都不去踩踏板了。因为无论谁去踩，对方都会把食物吃完，所以谁都不会有踩踏板的动力了。这个游戏规则的设计抑制了竞争，显然是失败的。结果是小猪大猪都会去踩踏板，反正对方不会一次性把食物吃完。这个规则的成本相当高（每次提供双份食物），而且竞争也不强烈，效果也不好。改变方案三：减量加移位方案。投食仅为原来的一半分量，但同时将投食口移到踏板附近。结果大猪和小猪都拼命抢着踩踏板，多劳多得，每次的收获刚好消费完。这个游戏的规则是最好的，成本不高，但收获最大。在现实生活中，公司的激励制度设计就必须充分利用智猪博弈的策略。如果公司的奖励力度太大，又是持股，又是期权，公司职员各个都成了百万富翁，成本高不说，员工的积极性并不一定很高；如果奖励力度不大，而且见者有份（不劳动的小猪也有），一度十分努力的大猪也不会有动力了；最好的激励机制就是———奖励并非人人有份，而是直接针对个人（如业务按比例提成），这样既节约了公司的成本，又消除了“搭便车”现象，能够实现有效的激励。随着社会生活各个方面的竞争性和对抗性的增强，随着人们对自身行为和决策的理性及效率的更高层次的追求，更多地利用博弈的原理指导我们的行动，能让我们在既定规则下选择更为适宜的策略，或是在制度设计、规则优化方面思路更开阔，考虑更全面，从而获得更加理想的结果。! 作者单位：国家发改委价检司"#$%&’———我对你诉说# 王春廷张海涛许多双手敲打着不同电话机上的#$%&’———这同一键盘不同声音诉说着问题疑难对可信赖的你发出渴望公平的呼唤你是一柄利剑高悬于不法经营者之顶违规“必斩”你是一把标尺准确丈量价格的法律界限事实为鉴因你的存在我们不再把受到的委屈强行吞咽因你的秉公经济上的损失被追还捍卫了应有的尊严价格领域的法官你倾听百姓的肺腑之言作出公正的评断你给出的满意答案就是一股春风化解了群众的抱怨因为你消费者们不再心烦意乱因为你迷茫中找到失落已久的主见有了你生活更加圆满有了你生存更觉安全每个人心中溢满由衷的称赞对你的认识也许并不全面但我们知晓“全心全意为人民服务”就是你工作的出发点及时准确严谨实办是你永恒的职业理念微欲微慎微独微权是你永不忘却的誓言让世间不再有狡诈欺是你不懈的追求即便是永久的失业也心甘情愿!#"$#%$&%’风雨中的一把伞!#"$#%$&%’寒冬里的一缕暖一株常青树因所有人的倾情浇灌枝繁叶茂茁壮参天!作者单位：山东省夏津县物价局!"
243 评论
小小小文er

8小时前发布
- 《博弈圣经》中《人类未知的蓝色档案》一文给出了博弈论的定义：“我们把动物利用大自然移动的瘾魂，在决策人期待的空间里，形成三维均衡的语文学理论，称为博弈论。”博弈圣经著作人说；博弈论是青年人的毒品，是无知者的兴奋剂，是沉默者的摇头丸。博弈论就是张冠李戴捕风捉影以讹传讹《博弈圣经》【典故】讽刺博弈论的最高博弈水平有人问博弈圣经著作人，什么是博弈论。他回答说；博弈论就是，一问、二答、三无知。也就是说；问者无知、回答者无知、听者更无知。有人追问，到目前为止，那么多博弈论图书，那么多作者，他们的最高博弈水平是什么？博弈圣经著作人一听就笑了；目前他们的最高博弈水平，就是想卖给你一本书，赢你一本书钱。博弈圣经著作人通俗的谈；菜鸟与金鸟，一个人想变得伟大，从一个菜鸟变成一个金鸟，就要利用国家实体特性造个金鸟笼。日后，就可以在媒体的报道中、绘声绘色地描述那个金鸟笼；他是某某大学院校、某某著名教授、某某首席科学家、某某诺贝尔奖得主、甚至某某政府官员，他就自然地钻进了金鸟笼。博弈论理论，它是太过于急躁、太过于草率的理论。由于博弈论新奇、古怪、原始，一个“囚徒困境”的三维谜团像似神话，人们又错误地认为博弈论能够取胜，因此受到了人们盲目的吹捧和疯狂的参与。人们把博弈取胜的欲望作为动力，一个人有了欲望，就要有实现欲望的对象和背景，加上自己行为的结果，才能取得想要的东西。博弈竞争的欲望在远古就出现了。欲望的天性就是进行交往，建立行为二特性对局，就是博弈的合作。但明眼的人都能看得出，他抄来的无效理论编成的一本本博弈论，就是张冠李戴、捕风捉影、“以讹传讹”，不管他从外国哪个地方抄来的，不管他抄了多少、编了多少本书、多少篇文章，究其低劣的学术品质，他仍然是一个菜鸟。假如博弈论大师，走出那个金鸟笼，再靠讲课赚大钱，靠卖书赚小钱，靠博弈取胜策略赚不到一毛钱，他就是，也许是一个罪犯。更为讽刺的是，一本本博弈论著作，古老的内容千篇一律，里面没有几句精彩的话，没有几个经典的词，更没有定理、定律、定义和法则。至今一个个博弈论专家、矛盾论专家、概率论专家和外行知道得一样多。
183 评论
长虹饮练

10小时前发布
- 博弈论是指某个个人或是组织，面对一定的环境条件，在一定的规则约束下，依靠所掌握的信息，从各自选择的行为或是策略进行选择并加以实施，并从各自取得相应结果或收益的过程，在经济学上博奕论是个非常重要的理论概念。什么是博弈论？古语有云，世事如棋。生活中每个人如同棋手，其每一个行为如同在一张看不见的棋盘上布一个子，精明慎重的棋手们相互揣摩、相互牵制，人人争赢，下出诸多精彩纷呈、变化多端的棋局。博弈论是研究棋手们 “出棋” 着数中理性化、逻辑化的部分，并将其系统化为一门科学。换句话说，就是研究个体如何在错综复杂的相互影响中得出最合理的策略。事实上，博弈论正是衍生于古老的游戏或曰博弈如象棋、扑克等。数学家们将具体的问题抽象化，通过建立自完备的逻辑框架、体系研究其规律及变化。这可不是件容易的事情，以最简单的二人对弈为例，稍想一下便知此中大有玄妙：若假设双方都精确地记得自己和对手的每一步棋且都是最“理性” 的棋手，甲出子的时候，为了赢棋，得仔细考虑乙的想法，而乙出子时也得考虑甲的想法，所以甲还得想到乙在想他的想法，乙当然也知道甲想到了他在想甲的想法… 面对如许重重迷雾，博弈论怎样着手分析解决问题，怎样对作为现实归纳的抽象数学问题求出最优解、从而为在理论上指导实践提供可能性呢？现代博弈理论由匈牙利大数学家冯·诺伊曼于20世纪20年代开始创立，1944年他与经济学家奥斯卡·摩根斯特恩合作出版的巨著《博弈论与经济行为》，标志着现代系统博弈理论的初步形成。对于非合作、纯竞争型博弈，诺伊曼所解决的只有二人零和博弈--好比两个人下棋、或是打乒乓球，一个人赢一着则另一个人必输一着，净获利为零。在这里抽象化后的博弈问题是，已知参与者集合(两方) ，策略集合(所有棋着) ，和盈利集合(赢子输子) ，能否且如何找到一个理论上的“解” 或“平衡” ，也就是对参与双方来说都最“合理” 、最优的具体策略？怎样才是“合理” ？应用传统决定论中的“最小最大” 准则，即博弈的每一方都假设对方的所有功略的根本目的是使自己最大程度地失利，并据此最优化自己的对策，诺伊曼从数学上证明，通过一定的线性运算，对於每一个二人零和博弈，都能够找到一个“最小最大解” 。通过一定的线性运算，竞争双方以概率分布的形式随机使用某套最优策略中的各个步骤，就可以最终达到彼此盈利最大且相当。当然，其隐含的意义在於，这套最优策略并不依赖于对手在博弈中的操作。用通俗的话说，这个著名的最小最大定理所体现的基本“理性” 思想是“抱最好的希望，做最坏的打算” 。 2.在经济学中，“智*博弈”（Pigs’payoffs）是一个著名博弈论例子。这个例子讲的是：*圈里有两头*，一头大*，一头小*。*圈的一边有个踏板，每踩一下踏板，在远离踏板的*圈的另一边的投食口就会落下少量的食物。如果有一只*去踩踏板，另一只*就有机会抢先吃到另一边落下的食物。当小*踩动踏板时，大*会在小*跑到食槽之前刚好吃光所有的食物；若是大*踩动了踏板，则还有机会在小*吃完落下的食物之前跑到食槽，争吃到另一半残羹。那么，两只*各会采取什么策略？答案是：小*将选择“搭便车”策略，也就是舒舒服服地等在食槽边；而大*则为一点残羹不知疲倦地奔忙于踏板和食槽之间。原因何在？因为，小*踩踏板将一无所获，不踩踏板反而能吃上食物。对小*而言，无论大*是否踩动踏板，不踩踏板总是好的选择。反观大*，已明知小*是不会去踩动踏板的，自己亲自去踩踏板总比不踩强吧，所以只好亲力亲为了。 “小*躺着大*跑”的现象是由于故事中的游戏规则所导致的。规则的核心指标是：每次落下的事物数量和踏板与投食口之间的距离。如果改变一下核心指标，*圈里还会出现同样的“小*躺着大*跑”的景象吗？试试看。改变方案一：减量方案。投食仅原来的一半分量。结果是小*大*都不去踩踏板了。小*去踩，大*将会把食物吃完；大*去踩，小*将也会把食物吃完。谁去踩踏板，就意味着为对方贡献食物，所以谁也不会有踩踏板的动力了。如果目的是想让*们去多踩踏板，这个游戏规则的设计显然是失败的。改变方案二：增量方案。投食为原来的一倍分量。结果是小*、大*都会去踩踏板。谁想吃，谁就会去踩踏板。反正对方不会一次把食物吃完。小*和大*相当于生活在物质相对丰富的“共产主义”社会，所以竞争意识却不会很强。对于游戏规则的设计者来说，这个规则的成本相当高（每次提供双份的食物）；而且因为竞争不强烈，想让*们去多踩踏板的效果并不好。改变方案三：减量加移位方案。投食仅原来的一半分量，但同时将投食口移到踏板附近。结果呢，小*和大*都在拼命地抢着踩踏板。等待者不得食，而多劳者多得。每次的收获刚好消费完。对于游戏设计者，这是一个最好的方案。成本不高，但收获最大。原版的“智*博弈”故事给了竞争中的弱者（小*）以等待为最佳策略的启发。但是对于社会而言，因为小*未能参与竞争，小*搭便车时的社会资源配置的并不是最佳状态。为使资源最有效配置，规则的设计者是不愿看见有人搭便车的，政府如此，公司的老板也是如此。而能否完全杜绝“搭便车”现象，就要看游戏规则的核心指标设置是否合适了。比如，公司的激励制度设计，奖励力度太大，又是持股，又是期权，公司职员个个都成了百万富翁，成本高不说，员工的积极性并不一定很高。这相当于“智*博弈” 增量方案所描述的情形。但是如果奖励力度不大，而且见者有份（不劳动的“小*”也有），一度十分努力的大*也不会有动力了----就象“智*博弈”减量方案一所描述的情形。最好的激励机制设计就象改变方案三----减量加移位的办法，奖励并非人人有份，而是直接针对个人（如业务按比例提成），既节约了成本（对公司而言），又消除了“搭便车”现象，能实现有效的激励。许多人并未读过“智*博弈”的故事，但是却在自觉地使用小*的策略。股市上等待庄家抬轿的散户；等待产业市场中出现具有赢利能力新产品、继而大举仿制牟取暴利的游资；公司里不创造效益但分享成果的人，等等。因此，对于制订各种经济管理的游戏规则的人，必须深谙“智*博弈”指标改变的个中道理。 3.背景知识：纳什博弈论的原理与应用 2002年03月21日17:44 北京晚报1950年和1951年纳什的两篇关于非合作博弈论的重要论文，彻底改变了人们对竞争和市场的看法。他证明了非合作博弈及其均衡解，并证明了均衡解的存在性，即著名的纳什均衡。从而揭示了博弈均衡与经济均衡的内在联系。纳什的研究奠定了现代非合作博弈论的基石，后来的博弈论研究基本上都沿着这条主线展开的。然而，纳什天才的发现却遭到冯·诺依曼的断然否定，在此之前他还受到爱因斯坦的冷遇。但是骨子里挑战权威、藐视权威的本性，使纳什坚持了自己的观点，终成一代大师。要不是30多年的严重精神病折磨，恐怕他早已站在诺贝尔奖的领奖台上了，而且也绝不会与其他人分享这一殊荣。纳什是一个非常天才的数学家，他的主要贡献是1950至1951年在普林斯顿读博士学位时做出的。然而，他的天才发现———非合作博弈的均衡，即“纳什均衡”并不是一帆风顺的。 1948年纳什到普林斯顿大学读数学系的博士。那一年他还不到20岁。当时普林斯顿可谓人杰地灵，大师如云。爱因斯坦、冯·诺依曼、列夫谢茨(数学系主任)、阿尔伯特·塔克、阿伦佐·切奇、哈罗德·库恩、诺尔曼·斯蒂恩罗德、埃尔夫·福克斯……等全都在这里。博弈论主要是由冯·诺依曼(1903—1957)创所立的。他是一位出生于匈牙利的天才的数学家。他不仅创立了经济博弈论，而且发明了计算机。早在20世纪初，塞梅鲁(Zermelo)、鲍罗(Borel)和冯·诺伊曼已经开始研究博弈的准确的数学表达，直到1939年，冯·诺依曼遇到经济学家奥斯卡·摩根斯特恩(Oskar Morgenstern)，并与其合作才使博弈论进入经济学的广阔领域。 1944年他与奥斯卡·摩根斯特恩合著的巨作《博弈论与经济行为》出版，标志着现代系统博弈理论的的初步形成。尽管对具有博弈性质的问题的研究可以追溯到19世纪甚至更早。例如，1838年古诺(Cournot)简单双寡头垄断博弈；1883年伯特兰和1925年艾奇沃奇思研究了两个寡头的产量与价格垄断；2000多年前中国著名军事家孙武的后代孙膑利用博弈论方法帮助田忌赛马取胜等等都属于早期博弈论的萌芽，其特点是零星的，片断的研究，带有很大的偶然性，很不系统。冯·诺依曼和摩根斯特恩的《博弈论与经济行为》一书中提出的标准型、扩展型和合作型博弈模型解的概念和分析方法，奠定了这门学科的理论基础。合作型博弈在20世纪50年代达到了巅峰期。然而，诺依曼的博弈论的局限性也日益暴露出来，由于它过于抽象，使应用范围受到很大限制，在很长时间里，人们对博弈论的研究知之甚少，只是少数数学家的专利，所以，影响力很有限。正是在这个时候，非合作博弈———“纳什均衡”应运而生了，它标志着博弈论的新时代的开始！纳什不是一个按部就班的学生，他经常旷课。据他的同学们回忆，他们根本想不起来曾经什么时候和纳什一起完完整整地上过一门必修课，但纳什争辩说，至少上过斯蒂恩罗德的代数拓扑学。斯蒂恩罗德恰恰是这门学科的创立者，可是，没上几次课，纳什就认定这门课不符合他的口味。于是，又走人了。然而，纳什毕竟是一位英才天纵的非凡人物，他广泛涉猎数学王国的每一个分支，如拓扑学、代数几何学、逻辑学、博弈论等等，深深地为之着迷。纳什经常显示出他与众不同的自信和自负，充满咄咄逼人的学术野心。1950年整个夏天纳什都忙于应付紧张的考试，他的博弈论研究工作被迫中断，他感到这是莫大的浪费。殊不知这种暂时的“放弃”，使原来模糊、杂乱和无绪的若干念头，在潜意识的持续思考下，逐步形成一条清晰的脉络，突然来了灵感！这一年的10月，他骤感才思潮涌，梦笔生花。其中一个最耀眼的亮点就是日后被称之为“纳什均衡”的非合作博弈均衡的概念。纳什的主要学术贡献体现在1950年和1951年的两篇论文之中(包括一篇博士论文)。1950年他才把自己的研究成果写成题为“非合作博弈”的长篇博士论文，1950年11月刊登在美国全国科学院每月公报上，立即引起轰动。说起来这全靠师兄戴维·盖尔之功，就在遭到冯·诺依曼贬低几天之后，他遇到盖尔，告诉他自己已经将冯·诺依曼的“最小最大原理”(minimax solution)推到非合作博弈领域，找到了普遍化的方法和均衡点。盖尔听得很认真，他终于意识到纳什的思路比冯·诺伊曼的合作博弈的理论更能反映现实的情况，而对其严密优美的数学证明极为赞叹。盖尔建议他马上整理出来发表，以免被别人捷足先登。纳什这个初出茅庐的小子，根本不知道竞争的险恶，从未想过要这么做。结果还是盖尔充当了他的“经纪人”，代为起草致科学院的短信，系主任列夫谢茨则亲自将文稿递交给科学院。纳什写的文章不多，就那么几篇，但已经足够了，因为都是精品中的精品。这一点也是值得我们深思的。国内提一个教授，要求在“核心的刊物”上发表多少篇文章。按照这个标准可能纳什还不一定够资格。 1996年诺贝尔经济学奖得主莫尔里斯当牛津大学艾奇沃思经济学讲座教授时也没有发表过什么文章，特殊的人才，必须有特殊的选拔办法。纳什在上大学时就开始从事纯数学的博弈论研究，1948年进入普林斯顿大学后更是如鱼得水。20岁出头已成为闻名世界的数学家。特别是在经济博弈论领域，他做出了划时代的贡献，是继冯·诺依曼之后最伟大的博弈论大师之一。他提出的著名的纳什均衡的概念在非合作博弈理论中起着核心的作用。后续的研究者对博弈论的贡献，都是建立在这一概念之上的。由于纳什均衡的提出和不断完善为博弈论广泛应用于经济学、管理学、社会学、政治学、军事科学等领域奠定了坚实的理论基础。囚犯的两难处境大理论中的小故事要了解纳什的贡献，首先要知道什么是非合作博弈问题。现在几乎所有的博弈论教科书上都会讲“囚犯的两难处境”的例子，每本书上的例子都大同小异。博弈论毕竟是数学，更确切地说是运筹学的一个分支，谈经论道自然少不了数学语言，外行人看来只是一大堆数学公式。好在博弈论关心的是日常经济生活问题，所以不能不食人间烟火。其实这一理论是从棋弈、扑克和战争等带有竞赛、对抗和决策性质的问题中借用的术语，听上去有点玄奥，实际上却具有重要现实意义。博弈论大师看经济社会问题犹如棋局，常常寓深刻道理于游戏之中。所以，多从我们的日常生活中的凡人小事入手，以我们身边的故事做例子，娓娓道来，并不乏味。话说有一天，一位富翁在家中被杀，财物被盗。警方在此案的侦破过程中，抓到两个犯罪嫌疑人，斯卡尔菲丝和那库尔斯，并从他们的住处搜出被害人家中丢失的财物。但是，他们矢口否认曾杀过人，辩称是先发现富翁被杀，然后只是顺手牵羊偷了点儿东西。于是警方将两人隔离，分别关在不同的房间进行审讯。由地方检察官分别和每个人单独谈话。检察官说，“由于你们的偷盗罪已有确凿的证据，所以可以判你们一年刑期。但是，我可以和你做个交易。如果你单独坦白杀人的罪行，我只判你三个月的监禁，但你的同伙要被判十年刑。如果你拒不坦白，而被同伙检举，那么你就将被判十年刑，他只判三个月的监禁。但是，如果你们两人都坦白交代，那么，你们都要被判5年刑。”斯卡尔菲丝和那库尔斯该怎么办呢？他们面临着两难的选择——坦白或抵赖。显然最好的策略是双方都抵赖，结果是大家都只被判一年。但是由于两人处于隔离的情况下无法串供。所以，按照亚当·斯密的理论，每一个人都是从利己的目的出发，他们选择坦白交代是最佳策略。因为坦白交代可以期望得到很短的监禁———3个月，但前提是同伙抵赖，显然要比自己抵赖要坐10年牢好。这种策略是损人利己的策略。不仅如此，坦白还有更多的好处。如果对方坦白了而自己抵赖了，那自己就得坐10年牢。太不划算了！因此，在这种情况下还是应该选择坦白交代，即使两人同时坦白，至多也只判5年，总比被判10年好吧。所以，两人合理的选择是坦白，原本对双方都有利的策略(抵赖)和结局(被判1年刑)就不会出现。这样两人都选择坦白的策略以及因此被判5年的结局被称为“纳什均衡”，也叫非合作均衡。因为，每一方在选择策略时都没有“共谋”(串供)，他们只是选择对自己最有利的策略，而不考虑社会福利或任何其他对手的利益。也就是说，这种策略组合由所有局中人(也称当事人、参与者)的最佳策略组合构成。没有人会主动改变自己的策略以便使自己获得更大利益。“囚徒的两难选择”有着广泛而深刻的意义。个人理性与集体理性的冲突，各人追求利己行为而导致的最终结局是一个“纳什均衡”，也是对所有人都不利的结局。他们两人都是在坦白与抵赖策略上首先想到自己，这样他们必然要服长的刑期。只有当他们都首先替对方着想时，或者相互合谋(串供)时，才可以得到最短时间的监禁的结果。“纳什均衡”首先对亚当·斯密的“看不见的手”的原理提出挑战。按照斯密的理论，在市场经济中，每一个人都从利己的目的出发，而最终全社会达到利他的效果。不妨让我们重温一下这位经济学圣人在《国富论》中的名言：“通过追求(个人的)自身利益，他常常会比其实际上想做的那样更有效地促进社会利益。”从“纳什均衡”我们引出了“看不见的手”的原理的一个悖论：从利己目的出发，结果损人不利己，既不利己也不利他。两个囚徒的命运就是如此。从这个意义上说，“纳什均衡”提出的悖论实际上动摇了西方经济学的基石。因此，从“纳什均衡”中我们还可以悟出一条真理：合作是有利的“利己策略”。但它必须符合以下黄金律：按照你愿意别人对你的方式来对别人，但只有他们也按同样方式行事才行。也就是中国人说的“己所不欲勿施于人”。但前提是人所不欲勿施于我。其次，“纳什均衡”是一种非合作博弈均衡，在现实中非合作的情况要比合作情况普遍。所以“纳什均衡”是对冯·诺依曼和摩根斯特恩的合作博弈理论的重大发展，甚至可以说是一场革命。从“纳什均衡”的普遍意义中我们可以深刻领悟司空见惯的经济、社会、政治、国防、管理和日常生活中的博弈现象。我们将例举出许多类似于“囚徒的两难处境”这样的例子。如价格战、军奋竞赛、污染等等。一般的博弈问题由三个要素所构成：即局中人(players)又称当事人、参与者、策略等等的集合，策略(strategies)集合以及每一对局中人所做的选择和赢得(payoffs)集合。其中所谓赢得是指如果一个特定的策略关系被选择，每一局中人所得到的效用。所有的博弈问题都会遇到这三个要素。价格战博弈：现在我们经常会遇到各种各样的家电价格大战，彩电大战、冰箱大战、空调大战、微波炉大战……这些大战的受益者首先是消费者。每当看到一种家电产品的价格大战，百姓都会“没事儿偷着乐”。在这里，我们可以解释厂家价格大战的结局也是一个“纳什均衡”，而且价格战的结果是谁都没钱赚。因为博弈双方的利润正好是零。竞争的结果是稳定的，即是一个“纳什均衡”。这个结果可能对消费者是有利的，但对厂商而言是灾难性的。所以，价格战对厂商而言意味着自杀。从这个案例中我们可以引伸出两个问题，一是竞争削价的结果或“纳什均衡”可能导致一个有效率的零利润结局。二是如果不采取价格战，作为一种敌对博弈论(vivalry game)其结果会如何呢？每一个企业，都会考虑采取正常价格策略，还是采取高价格策略形成垄断价格，并尽力获取垄断利润。如果垄断可以形成，则博弈双方的共同利润最大。这种情况就是垄断经营所做的，通常会抬高价格。另一个极端的情况是厂商用正常的价格，双方都可以获得利润。从这一点，我们又引出一条基本准则：“把你自己的战略建立在假定对手会按其最佳利益行动的基础上”。事实上，完全竞争的均衡就是“纳什均衡”或“非合作博弈均衡”。在这种状态下，每一个厂商或消费者都是按照所有的别人已定的价格来进行决策。在这种均衡中，每一企业要使利润最大化，消费者要使效用最大化，结果导致了零利润，也就是说价格等于边际成本。在完全竞争的情况下，非合作行为导致了社会所期望的经济效率状态。如果厂商采取合作行动并决定转向垄断价格，那么社会的经济效率就会遭到破坏。这就是为什么WTO和各国政府要加强反垄断的意义所在。污染博弈：假如市场经济中存在着污染，但政府并没有管制的环境，企业为了追求利润的最大化，宁愿以牺牲环境为代价，也绝不会主动增加环保设备投资。按照看不见的手的原理，所有企业都会从利己的目的出发，采取不顾环境的策略，从而进入“纳什均衡”状态。如果一个企业从利他的目的出发，投资治理污染，而其他企业仍然不顾环境污染，那么这个企业的生产成本就会增加，价格就要提高，它的产品就没有竞争力，甚至企业还要破产。这是一个“看不见的手的有效的完全竞争机制”失败的例证。直到20世纪90年代中期，中国乡镇企业的盲目发展造成严重污染的情况就是如此。只有在政府加强污染管制时，企业才会采取低污染的策略组合。企业在这种情况下，获得与高污染同样的利润，但环境将更好。谢谢采纳
167 评论

相关问题

热门问题