极小化极大算法
Minimax算法(亦稱 MinMax or MM)又名极小化极大算法,是一种找出失败的最大可能性中的最小值(最小化最坏情况)的算法。 概述 Minimax算法常用于棋类等由两方较量的游戏和程序。该算法是一个零总和算法,即一方要在可选的选项中选择将其优势最大化的选择,另一方则选择令对手优势最小化的方法。而开始的时候总和为0。很多棋类游戏可以采取此算法,例如井字棋(tic-tac-toe)。 偽代碼 function minimax(no…
共 33 篇文章
Minimax算法(亦稱 MinMax or MM)又名极小化极大算法,是一种找出失败的最大可能性中的最小值(最小化最坏情况)的算法。 概述 Minimax算法常用于棋类等由两方较量的游戏和程序。该算法是一个零总和算法,即一方要在可选的选项中选择将其优势最大化的选择,另一方则选择令对手优势最小化的方法。而开始的时候总和为0。很多棋类游戏可以采取此算法,例如井字棋(tic-tac-toe)。 偽代碼 function minimax(no…
墨菲定律(),又譯為-{zh-hk:墨菲定律; zh-tw:摩菲定律; zh-cn:摩菲定律;}-,通常表述为:有可能会出错的一定会出错(「Anything that can go wrong will go wrong.」)。 墨菲最初的引言是一条预防性设计建议:如果做某事有两種或是更多方式,而其中一种将导致灾难,则必定有人选择那种方式。 该定律和熱力學第二定律,增熵原理相关,即自然趋向于更加无序状态的趋势。 应用 在科學和演算法方面…
信息決策是決策科學所研究的一個方面,在現代知識經濟的發展下,信息在決策中發揮的發揮越來越大,信息決策作為一門普遍適用的科學開始被人們普遍關注。 信息决策四要素 北京大學秦铁辉教授认为,信息决策的定义为:个人或组织,为了实现其目标,从多种备选方案中选择较优的或最优一个,並且付諸實施的過程。一般來講,信息決策包括以下四個要素: 決策總是要付諸實施的,圍繞既定目標擬定各種實施方案是決策的基本要求。 決策總是要在若干不同的方案中進行比較和優選,…
解决问题或解難指通过克服障碍实现目标的过程,是大多数活动中经常出现的一部分。需要解决的问题范围从简单的个人任务(例如如何打开一个电器)到业务和技术领域的复杂问题。前者是简单问题解决(SPS)的例子,解决一个问题,而后者是复杂问题解决(CPS),涉及多个相互关联的障碍。解决问题的任务也可以分类为具有特定障碍和目标的明确定义的问题,以及情况棘手但不清楚应该追求什么样的解决方案的不明确定义的问题。同样,可以区分需要心理测量智力的形式或基于事实…
在心理學中,決策()是一種認知過程,經過這個過程之後,個人可以在各种選擇方案中,根據個人信念或是綜合各項因素的推理,決定出行動,或是決定出個人要向外表達的意見。每个决策过程都会以产生最终决定、选取最终选择为目标。而这些选择的形式可以是一种行动或选取的意见。 决策者做决定之前,往往面临不同的方案和选择、以及有关其决定后果的某种程度上的不确定性;决策者需要对各种选择的利弊、风险做出权衡,以期达到最优的决策结果。 決策可被定義為在數個方案中做…
战略或策略,是指为实现某种目标(如政治、军事、经济、商业或国家利益等方面的目标)而制定的高层次、全方位的长期行动计划。 历史上著名的战略 远交近攻 三分天下 联吴抗曹 西进巴蜀 农村包围城市 改革开放 大陆政策 参见 軍事戰略 营销战略 大战略 策略 (博弈論) 决策 *战术 参考文献
信息差距决策理论(英語:Info-gap decision theory)又稱資訊鴻溝決策理論,是一种非概率性决策理论,是為了在嚴重的不穩定性下藉由機會或意外收貨在失敗中尋求更佳的穩健性。特別是應用穩定性半徑類型的靈敏度分析對目標參數所給定估計值進行擾動。資訊鴻溝決策理論與Wald的maximin模型有一些相似,有一些學者認為它們不一樣,其他學者則認為它們是同一個原則。 信息差距决策理论最早由Yakov Ben-Haim于20世纪80年…
選舉是一種正式的決策過程,由人們投票選出某個職位的出任人選、或適用於整個組織的過程。因此,选举的性质有别于其他选择方法,如比赛筛选、随机决定或市场决定。选举通常被定义为被管治者意愿的一种正式表达方式,这些表达的意愿会集合并转化为一种集体决策,用来决定谁可以管治,包括谁可以继续执政、谁应该下台、和谁应该取而代之。 選舉是現代文明社會行使政治權力的重要方式。雖然沒有一套完美的、關於選舉之單一普世之國際標準,但確已形成一些共識,包括通過舉行自…
在不确定性情境下的决策过程中,若最佳行动方案的信息在固定决策作出后方才显现,人类常会产生被称为“决策遗憾”的情感反应。这种心理现象可量化为已执行决策与最优决策之间的价值差值。 遗憾规避理论(或称预期遗憾理论)指出,当个体面临抉择时,可能会预判未来可能产生的后悔情绪,并将这种规避心理纳入当前的决策考量。作为具有强烈社会属性与声誉关联的负面情感,遗憾机制不仅构成人类经验学习的重要基础,更是塑造风险厌恶心理的核心要素。该理论将对遗憾的有意识预…
認知偏誤(),或作認知偏差、認知偏見等,是一種在判斷中偏離規範或理性的系統模式。人們會根據對輸入的感知創造各自的「主觀現實」,個體的行為可能會被自己建構的現實支配,因此認知偏差可能導致知覺扭曲、不準確的判斷或廣義上的非理性。 儘管認知偏誤看似失常,有些偏差是適應性的,可以幫助人類找到捷徑以處理常見情況,或在特定情況下採取更有效的行動。認知偏差的研究始於1970年代丹尼尔·卡尼曼和阿摩司·特沃斯基的開創性工作,此後在認知科學、社會心理學和…
限制理性(),又譯為有限理性,係由赫伯特·亞歷山大·西蒙所提出,是基於生理學及心理學層面的思考,對於傳統經濟學理論所提出的修正。傳統經濟學一直以完全理性為前提,由於行為人可以得到所有資訊,因此可以在多種方案中,選擇能使效用最大化的一種方案;但是於現實狀況中,人們所獲得的資訊、知識與能力都是有限的,所能夠考慮的方案也是有限的,未必能作出使得效用最大化的決策。因此,西蒙認為必須考慮人的基本生理限制,以及由此而引起的認知限制、動機限制及其相互…
垃圾桶模式(),又稱垃圾桶模型、垃圾桶決策模式等。不同於理性選擇模式,垃圾桶模式認為組織的決策實際上處於无政府的混乱之中。 1972年,科恩、詹姆斯·馬奇和的《組織選擇的垃圾桶模式》()中提出該理論。 组织的无政府状态 组织的无政府状态,是组织或决策,具有數項特征:目標模糊、手段或方法的不確定和流动性参与。 ]]垃圾桶模式認為組織決策實際取決於組織內部四種流的互動與消長。 問題流、解決方案流和參與人員匯流至第四項決策機會流中,根據機會、…
required selecting from three incomparable alternatives (the goddesses shown). ]] 决策论()是一门横跨概率论、经济学和分析哲学的交叉学科。它通过结合期望效用和概率分析,探讨理性个体在不确定情境中的决策模式。与认知科学和行为科学不同,决策论本质上是规范性的,旨在识别理性主体在理想条件下的最优决策,而非描述人们实际如何做决定。 尽管如此,这一理论对社会科学研究…
在微观经济学中,消费者的间接效用函数(Indirect utility function)定义为满足预算约束时的最大效用,记为v(\mathbf{p}, w)。 如果效用函数u是连续的严格递增的函数,那么间接效用函数: 在R^n_{++}\times R_+上连续。 对(\mathbf{p},w)零次齐次。 对w严格递增。 对\mathbf{p}递减。 对(\mathbf{p},w)拟凸。 满足罗伊恒等式。 间接效用函数与支出函数 如果…
在機率及賽局理論上,秘书问题(Secretary problem),类似的名称有37%法則、麥穗理論、相亲问题、止步问题、见好就收问题、苏丹的嫁妆问题、挑剔的求婚者问题等,屬於。内容是这样的:要聘请一名秘书,有 n 个应聘者。每次面试一人,面试后就要立即决定是否聘他,如果当下决定不聘他,他便不会回来。面试后总能清楚了解应聘者的合适程度,并能和之前的每个人做比较。问什么样的策略,才使最佳人选被选中的概率最大。 求解最优策略 这个问题的最优…
决策分析(Decision Analysis, DA)是一门涵盖了以正式方式处理重大决策所需的哲学、方法论及专业实践的学科。该学科包含了大量的程序、方法与工具,旨在识别、清晰呈现并正式评估决策中的重要因素。通过将最大期望效用公理应用于构建良好的决策模型,决策分析能够为决策者提供建议的行动方案。它还致力于将决策的正式模型及其相应的建议转化为深刻的洞察,从而服务于决策者以及其他公司内外利益相关者。 参见 選擇 决策模型 决策支持系统 决策论…
探索-利用困境(exploration–exploitation dilemma),亦被称为探索-利用权衡(explore–exploit tradeoff),是决策过程中的一个核心概念,广泛存在于多个领域。它被描述为两种对立策略之间的平衡:利用(Exploitation)指根据对系统的当前认知(尽管这些认知可能是不完整或误导性的)选择已知最佳选项;而探索(Exploration)则指尝试新的选项,尽管会牺牲当前的利用机会,但可能在未来…
決策管理,也被稱為企業決策管理,是指企業將决策理论引入到日常的管理工作中。企业在管理工作中,为了实现某一特定目标,往往需要决策,即企业根據內外部條件从两个以上的可行方案中选择一个最优的方案,然后付诸实施。 参考文献
一致同意指在一特定情況下所有的人都表示同意。一致同意的時候,每個人都表達相同的意願,並且行動一致。許多團體以「一致同意」作為團結的象徵。一致同意可以用全部投贊成票來表達,或者以表決沒有反對來表達。 投票 如果投票要求一致同意才能通过,意味着所有投票者都拥有一票否决权。對於出現棄權是否可當作「一致同意」,並沒有一致的安排。根據罗伯特议事规则,一致同意是容許有棄權票的,而這情況稱作有「沉默同意」出現的「一致同意」,即無異議提出。與此相反,聯…
在微观经济学、博弈论、决策论中,预期效用假说(),又称预期效用理论(),或期望效用理论,是一个效用理论,指在风险情况下,个人所作出的选择是追求某一数量的期望值的最大化。这个理论最早在1738年由丹尼尔·伯努利提出,该假说用于解释赌博和保险中的期望值。 提出,在预期效用假说成立的前提下,一个有理性的人应该如何选择的公式。 历史 1738年,为解决圣彼得堡悖论,丹尼尔·伯努利提出了期望效用理论。论文主要包括两条原理: 边际效用递减原理:一个…