极小化极大算法
Minimax算法(亦稱 MinMax or MM)又名极小化极大算法,是一种找出失败的最大可能性中的最小值(最小化最坏情况)的算法。 概述 Minimax算法常用于棋类等由两方较量的游戏和程序。该算法是一个零总和算法,即一方要在可选的选项中选择将其优势最大化的选择,另一方则选择令对手优势最小化的方法。而开始的时候总和为0。很多棋类游戏可以采取此算法,例如井字棋(tic-tac-toe)。 偽代碼 function minimax(no…
共 104 篇文章
Minimax算法(亦稱 MinMax or MM)又名极小化极大算法,是一种找出失败的最大可能性中的最小值(最小化最坏情况)的算法。 概述 Minimax算法常用于棋类等由两方较量的游戏和程序。该算法是一个零总和算法,即一方要在可选的选项中选择将其优势最大化的选择,另一方则选择令对手优势最小化的方法。而开始的时候总和为0。很多棋类游戏可以采取此算法,例如井字棋(tic-tac-toe)。 偽代碼 function minimax(no…
搭便車問題()是一個典型的市場失靈問題,在使用公共財、共有財等資源時,消費者完全不願負擔其成本,或付出的金錢遠少於實際應該支付的份額,因此產生的問題。描述了在無法強制排除使用這類財貨的狀況下,當經濟主體可以輕易獲得財貨之利益時,可能發生的集體行動問題。概念名稱之「搭便車」字眼據稱源於站在早期路面電車上下車用踏板上乘車之逃票行為。 在日常生活中常可找到搭便車的例子,例如許多輪船公司不肯興建燈塔,它們可以獲得同樣的服務,此種問題會影響公共政…
沉没成本(),或称沉淀成本或既定成本,是经济学和制定过程中,会用到的概念,指已经發生且不可收回的成本。沉沒成本與形成對比,預期成本是採取行動可以避免的未來成本。換句話說,沉沒成本是過去支付的金額,與未來的決策無關。。 损失憎恶和沉没成本谬误 很多人对“浪费”资源很担忧害怕,被称为“损失憎恶”。比如说很多人会强迫自己看一场根本不想看的电影,因为他们怕浪费了买票的钱。这有时被叫做“沉没成本谬误”(然而對於完美主義者這也可能是一種滿足性效益)…
也稱「石头、剪子、布」或「剪子、包袱、锤」,是以三角-{克}-制為機制的猜拳遊戲。有时跟“投硬幣”、“掷骰子”有相同的功能,目的皆為产生随機结果以作决策。但有时它并不随機,因为游戏者可以根据经验,判断对手的手法。 规则 两个玩家先各自握紧拳,然后其中一人或者两人一起共同唸出口令,在说完最后一个音节的同时,两个玩家出示自己心中想好的手势(-{zh-cn:“石头”、“剪刀”或“布”; zh-hk:「包」、「剪」或「揼」; zh-tw:「剪刀…
战略或策略,是指为实现某种目标(如政治、军事、经济、商业或国家利益等方面的目标)而制定的高层次、全方位的长期行动计划。 历史上著名的战略 远交近攻 三分天下 联吴抗曹 西进巴蜀 农村包围城市 改革开放 大陆政策 参见 軍事戰略 营销战略 大战略 策略 (博弈論) 决策 *战术 参考文献
海萨尼·亚诺什·卡罗伊(, ,)-{zh-hans:,台译夏仙义;zh-hant:,大陸譯海薩尼}-,又譯豪尔沙尼,是一名出生於匈牙利布達佩斯的美籍經濟學家。他擁有犹太血统,是富裕药商的独子。1994年,他獲得諾貝爾經濟學獎。2000年因心臟病在美國柏克萊逝世。 他是最著名的要數他對博弈論的研究及博弈論應用於經濟學的貢獻。特別是他對不完備信息的博弈,即贝叶斯博弈的高度創新分析。他的重要貢獻還包括博弈論與經濟推理在政治和道德哲學(特別是功…
博弈复杂度()可以用许多方法加以衡量。本条目讲述其中的5種方法:状态空间复杂度()、博弈树的大小()、策略复杂度()、博弈树复杂度()與计算复杂度()。 博弈复杂度的衡量 状态空间复杂度 状态空间复杂度指的是从博弈最开始的状态可以变化出的符合规则的状态的数量。 一些知名博弈的复杂度 由于博弈复杂度非常巨大,下面表中一些数据只显示了以10为底数的指数部分。下面的表中的数值都需要小心对待:在博弈中,一个看起来很微小的规则变换会引起结果的巨大…
在經濟學相關領域中,動態不一致(英語:dynamic inconsistency)是指,決策者在某個時間點做出的最優計劃(英語:optimal plan)在以後的時間點不再是最優的情況。當參與者希望在參與期間更改所選策略時,這可能會在博弈論中發生。例如,政府可能會發現宣布緊縮貨幣政策以說服工人接受低加薪是最佳選擇。 一旦低薪漲幅被接受,政府可能會發現實施寬鬆的貨幣政策以提高產出更為可取。 動態不一致也出現在行為經濟學中,通常被稱為“時間…
共識動力學(consensus dynamics,agreement dynamics)是結合系统科学及图论的研究領域,其中研究的主要問題之一就是在多智能体系统中的共識問題(agreement problem,consensus problem)。 多智能体系统是指利用多個互相影響的智能設備來達到共同目的的系統。智能設備會形成網路,交換資訊以達到共識,這類系統包括生理系統、基因網絡、大型能源系統以及陸地、空中或太空中的車隊或是機隊。共識…
中间选民定理()是在1948年提出的一个与选择排序投票有关的模型。它指出,如果选民和候选人的政治光谱可以用一维坐标来表示,选民再根据候选人与自己的政治立场接近程度进行排序投票,并且投票规则为孔多塞投票法,那么立场最接近中间选民的候选人将会当选。 该定理与公共选择经济学和统计政治学有关。帕塔·达斯古普塔和埃里克·马斯金认为,这项定理证明了孔多塞投票法的合理性。普罗特多数决定原则平衡定理则将中間選民模型推广到二维空间。 早在1929年,哈羅…
议价能力指的是当事人在争论(如讨价还价、合同拟定以及达成协定)的过程中相互之间施加影响的能力。如果当事双方在争论中处于平等的地位,那么他们将具有同等的议价能力,例如在完全竞争市场中就正是如此。若是一方比另一方拥有更多更好的选择,則會造成议价能力不平等,工人與雇主之間就是如此。 很多领域都涉及议价能力这一概念,其中包括博弈论、勞動經濟學、集体协商、外交谈判、民间斗讼、保险价格谈判和任何常见的谈判。 计算 计算议价能力的方法有很多,其中比较…
限制理性(),又譯為有限理性,係由赫伯特·亞歷山大·西蒙所提出,是基於生理學及心理學層面的思考,對於傳統經濟學理論所提出的修正。傳統經濟學一直以完全理性為前提,由於行為人可以得到所有資訊,因此可以在多種方案中,選擇能使效用最大化的一種方案;但是於現實狀況中,人們所獲得的資訊、知識與能力都是有限的,所能夠考慮的方案也是有限的,未必能作出使得效用最大化的決策。因此,西蒙認為必須考慮人的基本生理限制,以及由此而引起的認知限制、動機限制及其相互…
在博弈论中,蜈蚣博弈(Centipede game)是一个扩展形式的博弈,两位参与者轮流选择是“背叛”,停止博弈拿走更大那份收益,还是“合作”,继续博弈把选择权让给对方。如果选择合作,收益会逐渐增加。其中,如果一位参与者选择合作而对手在下一期选择背叛,这位参与者得到的收益将小于直接选择背叛。 具体描述 假设蜈蚣博弈有两位参与者爱丽丝与鲍伯,爱丽丝先行动。开始时,爱丽丝面前有两堆硬币,一堆有四枚,另一堆则有一枚。每位参与者行动时要二选一:…
賽局理論(),又譯為对策论或-{zh-cn:赛局理论; zh-hk:賽局理論; zh-tw:博弈論;}-,是经济学的一个分支。1944年馮·諾伊曼與奥斯卡·摩根斯特恩合著《賽局理論與經濟行為》,標誌著現代系統賽局理論的初步形成,因此他們被稱為「賽局理論之父」。賽局理論被認為是20世紀經濟學最偉大的成果之一。目前可以應用在生物学、经济学、国际关系、電腦科學、政治学、军事战略,研究游戏或者博弈內的相互作用,是研究具有斗争或竞争性质现象的数学…
在經濟學中,完美信息()或無隱藏信息()是完全競爭的一個特徵。對於一個信息完美的市場,所有消費者和生產者都對所有的市場價格、自身的效用和自己的成本函數有完整和即時的了解。 在博弈論中,一個序貫博弈在以下情況被稱作具有完美信息:每個玩家在做出任何決定時完美地知道之前發生的所有事件,包括博弈的“初始化事件”(例如,紙牌遊戲中每個玩家的起手牌)。對對手隱藏某些方面的博弈(例如撲克中,手牌對對手隱藏)是不完美信息博弈的示例。 一個重要的點是,完…
在博弈论中,无名氏定理()是一类描述重复博弈纳什均衡的定理。起初,无名氏定理仅关注无穷博弈的纳什均衡。在1950年代,这类定理已经广受博弈论学者知晓,但并没有人发表它,所以称为无名氏定理。1971年发表的Friedman定理考虑了无穷博弈的一系列(SPE),把定理的初始版本推广到了更强的均衡概念上。 无名氏定理指出,如果参与者对未来足够有耐心(也即贴现因子 \delta \to 1 ),对于任意可行、满足个人理性假设的一组收益v=(v_…
在博弈论中,纳什均衡(,或稱纳什均衡点)是指在包含兩個或以上參與者的非合作博弈()中,假設每個參與者都知道其他參與者的均衡策略的情況下,沒有參與者可以透過改變自身策略使自身受益時的一個概念解。該術語以约翰·福布斯·納什命名。在博弈論中,如果每個參與者都選擇了自己的策略,並且沒有玩家可以透過改變策略而其他參與者保持不變而獲益,那麼當前的策略選擇的集合及其相應的結果構成了納什均衡。即若p_i(s)= max_{r_i} [ p_i(s; r…
合作性競爭,又稱競合,是商業上的時髦詞語。卡特爾就是一個著名的例子,一組公司互相合作來減少競爭。相反地,合作性競爭的焦點放在競爭性的市場中的公司之間的合作。 一些看法對競爭抱持相對否定的態度,像是Tom DeMarco的《怠惰:超越倦怠、忙碌工作,及完全效率的神話》(Slack: Getting Past Burnout, Busywork, and the Myth of Total Efficiency)一書就有段話說「在知識組織中…
在福利经济学中,如果某项改变能使社会中至少一人境况改善,同时又不使任何人的境况比之前更差,则该改变被称为帕累托改善()。如果所有可能的帕累托改善都已实现,则该状况被称为帕累托效率()或帕累托最优();换言之,此时已不存在任何既能使某人境况改善,又不使另一人境况恶化的方法。这个概念的提出者是意大利社會學家维尔弗雷多·帕累托(1848-1923),并以他的名字命名。 在社會選擇理論中,这一概念有时被称为“一致性原则”,其指出:如果社会中的每…
雪莉的生日()是一個数学问题的非正式名稱,是新加坡及亞洲中學數學奧林匹克競賽的題目,在2015年4月10日由江堅文(Kenneth Kong)貼上Facebook,之後在網路上爆紅,已獲得《紐約時報》、《衛報》、英国广播公司(BBC)的報導,出題者也相當意外。 在題目中,名叫雪莉(Cheryl)的女生給了她剛認識的朋友艾伯特(Albert)和柏納(Bernard)一些有關她生日的資訊,讀者要根據這些資訊及她朋友的回覆判斷雪莉的生日。 起…