标签:#博弈论

共 104 篇文章

斯塔克爾貝格競爭

斯塔克尔伯格模型由德国经济学家斯塔克爾貝格在20世纪30年代提出,是一个价格领导模型,厂商之间存在着行动次序的区别。 理論內容 雖然與古诺模型一样,斯塔克尔伯格模型同樣在讨论生产同质产品的寡头厂商之间如何决定产量,但后者与前者并不一样。 斯塔克尔伯格模型認為产量的决定依据以下次序:领导性厂商决定一个产量,然后跟随厂商可以观察到这个产量,然后根据领导性厂商的产量来决定他自己的产量。需要注意的是,领导性厂商在决定自己的产量的时候,充分了解跟…

最小最大值定理

最小最大值定理也称博弈论基本定理,是一个关于最大最小不等式等号成立的条件的定理。该定理最先于1928年由冯·诺伊曼证明。 内容 该定理声称:若X\subseteq\mathbb{R}^n,Y\subseteq\mathbb{R}^m为紧致凸集。f:X\times Y\rightarrow \mathbb{R} 为连续的凸-凹函数(即f(x,y)关于x是凸函数,关于y是凹函数)。则: :\max_{y\in Y}\min_{x\in X}…

非零和博弈

非零和博弈与零和博弈相对。零和博弈表示所有博弈方的利益之和固定,即一方有所得,其他方必有所失。非零和博弈表示在不同策略组合下各博弈方的得益之和為不确定的变量,又称为变和博弈(variable-sum / non-constant-sum game)。在零和博弈中,博弈各方是不合作的。如果某些战略的选取可以使各方利益之和变大,同时又能使各方的利益得到增加,那么,就可能出现参加方相互合作的局面。因此,非零和博弈中,博弈各方存在合作的可能性。…

彭尼的游戏

彭尼的游戏(Penney's game)由沃尔特·彭尼()提出,是一个两个玩家之间生成用“正面”和“反面”为代称产生二进制数列的游戏。玩家A报出至少包含3个项、每项只能是正面或反面的序列,然后展示给玩家B;玩家B则给出等长的正面反面序列。随后, 投掷一面均匀的硬币,观察正反,直至投掷出一段序列刚好和某个玩家的序列吻合,则该名玩家获胜。 将序列中每个正面或者反面的判断称为比特(bit),使用长度为3比特的序列,玩家B相对玩家A有优势。这是…

完全信息

在經濟學和博弈論中,完全信息(又譯完整信息、完備信息,)是這樣一種經濟狀況或博弈:其中所有參與者都可以獲得有關其他參與者的信息,因此,參與者的效用函數(包括風險厭惡)、收益、策略和“類型”都屬於。完全信息是指博弈中的每個玩家都知道整個博弈過程中的順序、策略和收益的概念。給定這些信息,玩家有能力根據這些信息進行相應的計劃,以最大化他們在博弈結束時自己的策略和效用。 相反,在不完全信息博弈()中,玩家並不掌握對手的全部信息。一些玩家擁有私密…

雙輸

雙輸是博弈論的一個概念,指參與博弈的各方無論怎樣都必然有所損失而且都不會得益。雙輸的情況多數都是不能被預防或避免的。強制被動及囚徒困境都可能引起雙輸。 参见 零和博弈 皮洛士式胜利

賽局理論中的特殊賽局

賽局理論研究賽局模型中,兩個以上參與者進行策略性互動的過程。理論中許多特殊的賽局模型有特定名稱,本條目列出其中研究最为广泛的一些賽局模型。 賽局的構成要件簡介 視不同的研究範疇而定,一個賽局可由各種理論要件構成。以下介紹最基本且共通的幾個要件。 參與者人數:在賽局中,自主做出決策並行動,且能從最後的決策組合得到償付的每個個體,都是一個參與者。 決策次數:參與者在賽局中從數個行動分支中擇一的行為即為決策,所產生的策略為"單純策略"。若賽局…

旅行者困境

博弈论中,旅行者困境是一种非零和博弈,博弈双方都为了让自己收益最大化,而不考虑对方收益。 该博弈是1994年由印度經濟學家考希克·巴苏教授(Kaushik Basu)提出,博弈情形如下: :航空公司丢失了两位互相不认识乘客的旅行包。两个旅行包正好都是一样的,并且里面有相同价值的古董,两位乘客都向航空公司索赔1000美元。为了评估出古董的真实价值,公司经理将两位乘客分开以避免两人合谋,分别让他们写下古董的价值,其金额必須是整數,而且要不低…

少数派博弈

厄爾法羅酒吧問題,又稱少數派博弈,是一種經常出現在經濟活動中的博弈行為。該模型源自由1994年W·布萊恩·亞瑟提出了El Farol酒吧問題。 在这一博弈中,参与者们拥有两种选择(例如0和1)。所有人都做出选择之后,将参与者按照所做的选择分为两派。人数较少的那一方,也就是少数派将会获胜。该博弈还可以进一步分为是否多次进行,参与者是否记得之前游戏的结果等多种类型。 变体形式 El Farol酒吧问题 El Farol酒吧問題(El Far…

相关均衡

在賽局理論中,相關均衡是一個比眾所周知的納許均衡更普遍的解概念。數學家罗伯特·约翰·奥曼在1974年首次討論了這個問題。其思想是,每個參與者根據自己對同一公共信號的價值的私人觀察來選擇自己的行動。策略將行動分配給玩家所能觀察到的每一個可能的情況。如果沒有參與者想要偏離他們的策略(假設其他人也不偏離),那麼信號的分佈就被稱為相關均衡。 參考文獻

图博弈论

在博弈论中,描述博弈论的常用方法有正则形式的博弈和扩展形式的博弈。图博弈论是参与者之间简洁博弈的表示形式。 考虑一个博弈,有n个参与者,每个人有m种策略。我们将任何一个参与者表示为一个图中的节点,在这个图中,每个参与者都有一个效用函数,这个效用函数仅仅与其邻居有关。该效用函数依赖的其他参与者越少,图示也就越小。 形式定义 博弈由图G表示,其中每个参与者由图中的一个节点表示,当且仅当图中的两个节点i和j的效用函数相互依赖时,则它们之间有一…

重复博弈

在博弈论,重复博弈所指的是一类特殊的擴展形式的博弈(extensive form game)。此类博弈中包含一个基础博弈(base game)——称为阶段博弈(stage game);在整个重复博弈中,该阶段博弈会被重复一定次数。阶段博弈一般是一个大家熟悉的博弈(如囚徒困境)。类似的,非重复博弈也可称为单一阶段博弈(single stage game)或单次博弈(single shot game)。 在重复博弈中,每个参与者会考虑自己当…

用餐者困境

在博弈论中,用餐者困境是一个多参与者的囚徒困境。设想的情景是有若干人出去吃饭,在点菜之前他们达成了一致:所有人平摊买单的钱。现在每个人要么点贵的菜肴,要么点便宜的菜肴。假设贵的菜肴比便宜的要好,但是如果一个人单独进食的话,不能保证點贵的菜肴多付的钱一定值得。如果每个人都这么推想,那麼所有人將會點便宜的菜肴。如果点了更贵的菜肴,额外加的钱將被眾人摊分,所以额外加的钱是較少的,而菜肴的味道却会有较大的改善,因此多花的钱是划算的。每个人都这样…

契约经济学

契约经济学研究的是经济主体如何通过特定的契约安排来解决信息不对称问题,在经济学中属于資訊經濟學的一部分。 当委托人对于代理人的特征不知情的情况下,会产生逆向选择问题。这个经济学分支的先驱者是乔治·阿克洛夫,他阐述了旧车市场的逆向选择问题。在一些模型中,例如迈克尔·斯彭斯的劳动市场模型中,代理人能够进行发送自己类型的信号给委托人方,可能有助于解决这类问题。 在道德风险模型中,信息的不对称是因为委托人没有能力去观察其代理人的行为。因此,基于…

反公地悲剧

反公地悲剧(tragedy of the anticommons)是1998年由美国教授Heller提出的。它是指本应公有的产权由于细分化、私有化导致社会未能充分利用资源的情形。是由公地悲剧产生的衍生词汇。 与公地悲剧中由于资源过度利用所产生的问题相反,反公地悲剧是由于权利者较多,而权利者之间互相妨碍彼此对资源的利用,导致资源无法被充分利用甚至闲置而对社会利益造成损失。两者都是由未能处理好私有产权和公有产权间的关系所产生的问题。 在知识…

正则形式的博弈

在博弈论中,正则形式(Normal-form game)是描述博弈的一种方式。与延展形式不同,正则形式不用图形来描述博弈,而是用矩阵来陈述博弈。与延展形式的表述方式相比,这种方式在识别出严格优势策略和纳什均衡上更有用,但会丢失某些信息。博弈的正则形式的表述方式包括如下部分:每个参与者所有显然的和可能的策略,以及和与其相对应的收益。 在非完美信息的完全静态博弈中,正则形式的表述方式详细地说明了参与者策略空间和收益函数。策略空间是某个参与者…

支配性策略

優勢策略又称为支配性策略(Dominant Strategy)。在一个博弈當中,假設能選擇的策略為\{x_1,x_2,x_3,...,x_n\},n\in \Zeta^+,無論對手採取什麼策略,x_i,i\in \Zeta^+都可以得到比採取其他策略更好的结果,那麼,策略x_i就是優勢策略。 或者,使用混合策略,以\{y_1,y_2,y_3,...,y_m\},m\in \Zeta^+,m使用某些策略\{x_1,x_2,x_3,...,…

对称博弈

在博弈论中,如果博弈的收益只依赖于选手所选择的策略而不依赖于进行博弈的选手,那么这类博弈就被称为对称博弈。对称博弈存在着不同的种类。例如,在囚徒困境的博弈中,囚徒都选择认罪的结果为都判刑5年,都选择不认罪的结果为都判刑1年,一个选择认罪一个不认罪的结果分别为判刑10年与释放。在这个博弈中,囚徒最终判刑的年数只要他选择认罪与否有关,而与他的身份无关,这就是一个对称博弈。用表格表示如下。 一般情况 对于参与者i而言,博弈的收益为U_i\co…

空间演化博弈

空间演化博弈是一种基于细胞自动机的生物数学博弈模型。这一模型通过利用按照博弈规则进行演化的细胞自动机,来获知个体的背叛怎样在未来影响群体的合作-背叛状况。该模型可用于研究细菌、社会等系统模型。 基本模型 空间演化博弈的基本模型由马丁·A·诺瓦克和发表于1992年10月29日的《自然》期刊上,题为「Evolution games and spatial chaos」。。 参考文献

序贯均衡

序贯均衡是由和罗伯特·B·威尔逊提出的一種改進版的纳什均衡。和罗伯特·B·威尔逊認為,在的概念中,对非均衡路径(off-equilibrium paths)上的后验概率没有定义,可以任意取值,而如果对非均衡路径上的后验概率作出合理的限制,就可以使得博弈论中的均衡概念更为一般化。 参考文献