标签:#博弈论

共 104 篇文章

最壞均衡與最佳解比

最壞均衡與最佳解比(,PoA),是賽局理論中的一個概念,目的是為了衡量在一個賽局中,由於參與者的自私所導致整個系統的效能降低。在這個概念中,所謂的系統和效率可以指很多方面。例如在一個城市裡交通中,有A和B兩個地點,有一群人開車從A前往B,而在這兩個地點之間有不止一條道路可以選擇。在這個模型裡,效率指的是這群人到達目的地所需要的平均時間,這些參與者可以通過集中決策從而達成最佳效率,也可以基於自私的立場而決定自己的決策,從而達成一個或多個纳…

智猪博弈

在博弈论中,智猪博弈()是一个著名的例子,用来说明纳什均衡。 分析 在长条形的猪圈中关着大小两头猪。猪圈一端有一个猪食槽,另一端有一个按钮,可以控制猪食槽中的食物,按下按钮后就有10单位的猪食进入食槽。大猪进食的速度快,如果大猪先到达食槽处,可以吃到9个单位的猪食(小猪吃到剩余的食物,下同);如果同时到达,大猪吃到7个单位猪食;如果小猪先到,大猪吃到6个单位。另外,按下按钮者跑到猪食槽处需要付出2单位猪食的代价。假设两头猪从按钮处跑到猪…

承諾續擴

承諾續擴、承諾升級或承諾升高(),為一種行為模式,指稱當某個體或團體面對日益增高的負面結果,反而會持續合理化既存的決策、動作和投資的現象,而非改變它們。 這種行為模式的本質在於沉没成本謬誤,此謬誤被經濟學者和行為科學家用來描述,當人們證實先前累積的投資額(沉沒成本)都已經浪費掉了,反而會因為覺得過去已經投入而且不能回收的成本很「浪費」,因而做出不理性的選擇,比如說當消費者發現電影票不能退費時,很多人會強迫自己看一場根本不想看的電影,因為…

小决定暴政

小决定暴政()是美国经济学家在1966年的一篇同名论文中提出的现象。这篇论文中指出:一些对于个人而言不需要做太多事情或花太多时间的决策,可以累积得到不理想的结果;由是,一系列对个体而言尚属理性的的小决定可以损害后来决策发生的条件,甚至使得所有可以令人接受的选项均不可逆转地被破坏。卡恩将这一现象描述为市场经济的普遍情形,且认为这一现象可能导致了市场失灵。、政治投票,乃至健康危机等议题上都有所使用。 小决定暴政的一个经典案例即为加勒特·哈丁…

全支付拍卖

全支付拍卖()是经济学与博弈论中的一种特殊的拍卖模型。这一模型中,竞拍者凡是报价,就需要如所报价格支付,但和传统的竞拍一样,只有报价最高者可以获得竞拍品。 全支付拍卖模型的納什均衡點存在于所有竞拍者均采取混合策略时,其期望回报为零。卖家的期望收益即为竞拍品的价值。但在一些真实的实验中,溢价是普遍现象,且在长远来看,頻繁得標反而最有可能導致损失。 形式 塔洛克拍卖()或塔洛克博彩()是全支付拍卖模型最直接的形式,其中无论赢家和輸家都必须支…

元游戏 (游戏方法)

元游戏(),或者关于游戏的游戏,是指任何超越规定的游戏规则、利用外部因素来影响游戏、或超越游戏所设定的限制或环境的游戏方法。 元游戏也可以指一种游戏方法是创建或修改子游戏的规则的游戏,玩家可以选择在游戏过程中将哪些规则应用于游戏本身。 例子 在国际象棋中,有一套特殊的棋步可以让棋手赢在第四步棋。 弈者A一直在观察弈者B下棋,而在过去的五局比赛中,弈者B连续五局都试图使用这四步棋取胜。 当弈者A坐下来与弈者B下棋时,如果弈者A利用先前观察…

阿罗悖论

阿罗不可能定理()或阿罗悖论()指的是諾貝爾獎得主肯尼斯·阿羅提出的一項社會理論。其描述的是在有三個以上的選項時,沒有任何「排名投票」機制可以既把個人偏好的排名轉變為代表整個群體的排序,而且還兼顧普遍性(不考慮特別限制以外的所有民眾都能投票)、非獨裁(并非由唯一選民決定結果)、帕累托效率(有人變好就要有人變差),以及獨立性(不相干的人投票不應連動)。 命题 有 N 种选择,有 m 个决策者,他们每个人都对这 N 个选择有一个从优至劣的排…

预期效用假说

在微观经济学、博弈论、决策论中,预期效用假说(),又称预期效用理论(),或期望效用理论,是一个效用理论,指在风险情况下,个人所作出的选择是追求某一数量的期望值的最大化。这个理论最早在1738年由丹尼尔·伯努利提出,该假说用于解释赌博和保险中的期望值。 提出,在预期效用假说成立的前提下,一个有理性的人应该如何选择的公式。 历史 1738年,为解决圣彼得堡悖论,丹尼尔·伯努利提出了期望效用理论。论文主要包括两条原理: 边际效用递减原理:一个…

帕隆多悖论

帕隆多悖论('),是博弈论中的悖论,指多個失败策略的组合反成为获胜策略*。 1996年,发现此悖论。 帕隆多在对布朗棘轮的分析中设计此悖论。布朗棘轮是物理学家费曼的思想实验,設想一台能从的随机热运动中提取能量的機器。在仔細分析时,有關布朗棘轮的悖论就消失了。 在帕隆多以前,生物学便探索了許多由失败策略组成的致胜策略。 参考 腳註 延伸阅读 John Allen Paulos, [https://books.google.com/book…

贝叶斯博弈

在博弈论中,贝叶斯博弈()所指的是:博弈参与者对于对手的收益函数,無法獲得完全訊息(complete information);因此贝叶斯博弈也被称为不完全訊息博弈。因為使用了貝葉斯法則(Bayes' rule)來進行機率分析,因此得名。 匈牙利经济学家海萨尼·亚诺什·卡罗伊在1967年和1968年的三篇论文中介绍了贝叶斯博弈的概念,这些研究使他获得了1994年的诺贝尔经济学奖。 概述 在约翰·海萨尼的研究框架下,我们可以将自然(Nat…

圣彼得堡悖论

圣彼得堡悖论(St. Petersburg paradox)是决策论中的一个悖论,由尼古拉一世·伯努利于1713年提出。1738年,丹尼尔·伯努利以效用理論來解答這個問題,因此形成預期效用理論。 問題內容 1730年代,数学家丹尼尔·伯努利的堂兄尼古拉一世·伯努利,在致法國數學家皮耶·黑蒙·德蒙馬特的信件中,提出一个問题: 有一個「掷硬币擲到正面為止」的賭局,第一次掷出正面,就給你1元。第一次掷出反面,那就要再掷一次,若第二次掷的是正面…

最後通牒賽局

最后通牒賽局是经济学和比較心理學中博弈论的一种实际应用。1982年沃纳·古斯等首次把它做成试验。最后通牒賽局的试验常被用来研究利他主义或利己主義。使用最后通牒賽局的不同试验布置可以研究人类在试验中是否只为扩大自己的盈利还是在试验中也顾及其他人的利益。对其他人的顾及可以来源于赛局中为自己或者大家带来利益的规则、文化习俗如正义感以及自己对其他人和观察者留下的印象。神经生物学的试验也成功地使用最后通牒賽局,比如用来探测大脑损伤对行为造成的影响…

囚徒困境

囚徒困境()、囚犯兩難是博弈论的非零和博弈中具代表性的例子,反映個人最佳選擇並非群體的最佳選擇,且在一个群体中,个人做出理性选择却往往导致集体的非理性。雖然這是一個理論上的情境,但現實中的價格競爭等也會出現類似情況。 單次發生的囚徒困境,和多次重複的囚徒困境結果不會一樣。 在重复的囚徒困境中,博弈被反复地进行。因而参与者都有机会去“惩罚”另一个参与者前一回合的不合作行为。这时,合作可能会作为均衡的结果出现。欺骗行为被受到惩罚的威胁所制止…

扩展形式的博弈

博弈论中,与正則形式相应,扩展形式()通过树来描述博弈。每个节点(称作决策节点)表示博弈进行中的每一个可能的状态。博弈从唯一的初始节点开始,通过由参与者决定的路径到达终端节点,此时博弈结束,参与者得到相应的收益。每个非终端节点只属于一个参与者;参与者在该节点选择其可能的行动,每个可能的行动通过边从该节点到达另一个节点。 和正则形式不同,扩展形式允许互动的显式模型(explicit modeling of interactions),互动…

模糊厌恶

模糊厌恶(),意指在所有伴随风险的不确定性中下注的话,人们倾向于下注已知的不确定类型,而不是未知类型。比如,盒子里有100个球,你愿意赌能够随机摸出的球为红色——如果已知有50个在其中的话。如果盒子里有什么颜色的球全然未知,那么你不会愿意为之下注红色的。一般的风险事情具有确定的概率计算,而暧昧事件则具有更大的不确定性,因为概率分布本身可能就是未知的。 此现象最早见于1920年代的M.Keynes以及F.Knight各自的论述,随后逐渐被…

谢林点

谢林点(),又译为薛林点,或称为聚焦点(),是博弈论中人们在没有沟通的情况下的选择倾向,做出这一选择可能因为它看起来自然、特别、或者与选择者有关。美国诺贝尔奖获得者托马斯·谢林于1960年在《冲突的策略》一书中提出該概念。在该书中,谢林描述“每个人期望的聚焦点是他人期望他本人期望被期望做出的选择。”这种概念后来以谢林的名字命名。 例如:两个独立不能交流的人,都被要求从四个球中选择一个,当且仅当两人选中同一个球则获得奖励。四个球中三个是蓝…

理性主体

理性主体()是指具有明确的喜好,通过期望对不确定性事件建立决策模型,并能够在所有可行方案中总是选择执行对自己最有利的行为。在经济学、博弈论、决策论、人工智能、认知科学、道德、哲学(包括实践推理)等领域都会对理性主体进行研究。 一个理性主体可以是任何能够作出决定的主体。可以是一个人、一个公司,也可以是机器或者软件。 理性主体行事主要依据以下几点: 该主体的偏好。 该主体的背景信息,包括经验。 该主体可选的行动、它的责任和义务。 该主体行动…

策梅洛定理 (博弈論)

策梅洛定理()是博弈論的一條定理,以德國數學家恩斯特·策梅洛命名。定理表示在二人的有限遊戲中,如果雙方皆擁有完全的資訊,並且運氣因素並不牽涉在遊戲中,那先行或後行者當中必有一方有必勝/必不敗的策略。若運用至國際象棋,則策梅洛定理表示“要麼黑方有必勝之策略、要麼白方有必勝之策略、要麼雙方也有必不敗之策略”。 策梅洛的論文於1913年以德文發表,並被烏爾里希·施瓦伯(Ulrich Schwalbe)和保羅·沃克(Paul Walker)於1…

穩定婚姻問題

在組合數學、經濟學、電腦科學中,穩定婚姻問題(,簡稱SMP)又稱為穩定配對問題(stable matching problem),是指在兩組同樣大小的元素集合中(例如集合1是男子組、集合2是女子組,而他們各有偏好),尋求一個穩定配對組合所遇到的問題。一個組合在以下情況下並不穩定: 在集合1中有一個元素A更偏好於集合2的一些元素B,但元素A已被配對;而元素B亦更偏好於元素A多於配對給他的元素。在男女婚姻的角度來說,可以寫成一名男子A獲安排…

石头、剪子、布、蜥蜴、史波克

方向分别为:剪子、布、石头、蜥蜴、史波克。]] 石头、剪子、布、蜥蜴、史波克()是一种由石头、剪子、布延伸出来的博弈论猜拳游戏,游戏的发明者是山姆和卡伦,与石头、剪子、布不同的是,“石头、剪子、布、蜥蜴、史波克”在石头、剪子、布的基础上增加了两种手势,分别为动物蜥蜴和星际旅行的主要人物史波克。石头、剪子、布的手势和通俗猜拳游戏基本一致,蜥蜴的手势为一个蜥蜴面部的手势,而史波克的手势则为著名的瓦肯举手礼。这个新式的猜拳游戏减少了原石头、剪…