它是怎么回事?
纳什均衡指在其他参与者策略不变时,任何一方都不能通过单方面改变策略获益。均衡不意味着公平、合作或整体最优,也可能不唯一。
与「进化稳定策略」相连时,本条先处理“列出参与者与策略”,再用“寻找规则改变”收束;进化稳定要求抵抗少量入侵;一般纳什均衡不自动满足这个更强条件。
本文为学习性整理,案例与实践步骤为编辑转化。
为什么会起作用?
- 01
纳什均衡是给定他人策略时,任何一方都不能通过单方面改变策略改善自身收益的状态。它不保证整体最好、公平,也不保证实际互动必然达到。
- 02
对象与边界:稳定的选择组合,也可能让所有人都不满意。使用前要先确认“各方都知道结果不好,却没有人愿意先改变时。”,避免把相似现象直接套入模型。
- 03
转换路径:从“列出参与者与策略”形成列出参与者与策略的记录,再经过“寻找改变收益或规则的办法”推进到寻找改变收益或规则的办法的记录;中间的事实、假设和判断应分别记录。
原汇编可对照;学术归属待核
原理论与本站实践模板的证据应分别理解
它从哪里来?
约翰·纳什在博弈论中发展了均衡概念和存在性结果。实际应用需先定义参与者、策略与收益。
本站依据「John F. Nash, Jr. · 访谈」记录当前来源线索,并把历史概念转成可填写的实践流程。本人访谈已核;不将均衡等同社会最优,所以来源归属与实际效果分开判断。
与本模型直接相关的中文要义是:稳定的选择组合,也可能让所有人都不满意。纳什均衡是给定他人策略时,任何一方都不能通过单方面改变策略改善自身收益的状态。它不保证整体最好、公平,也不保证实际互动必然达到。 所列资料定位在「John F. Nash, Jr. · 访谈」的“关于 Equilibrium Points in N-person Games 与 Non-Cooperative Games 的回答”;当前状态为“本人访谈已核;不将均衡等同社会最优”,因此摘要用于理解原义,不能替代引文校勘或效果验证。
查看来源 ↗一句值得带走的话
稳定的选择组合,也可能让所有人都不满意。
编辑提炼,非人物原话
什么时候用?
各方都知道结果不好,却没有人愿意先改变时。
用适合这个模型的步骤,慢慢想清楚。
- 01
列出参与者与策略
谁能单方面改善自己的结果?
输入:本次具体问题、当前情境与已知资料
本步产出:列出参与者与策略的记录
列出参与者与策略的记录说明了对象、范围与判断标准吗?能否从实际变化识别是否达成?
- 02
分析相互条件下的最佳回应
当前规则奖励什么?
输入:前一步的列出参与者与策略的记录,以及本步需要补查的资料
本步产出:分析相互条件下的最佳回应的记录
分析相互条件下的最佳回应的记录中,已知事实与待核实的判断是否分开记录?
- 03
寻找改变收益或规则的办法
改变哪项规则可能改善均衡?
输入:前一步的分析相互条件下的最佳回应的记录,以及本步需要补查的资料
本步产出:寻找改变收益或规则的办法的记录
寻找改变收益或规则的办法的记录是否说明预期观察、允许的代价与停止条件?未知负责人和时间保留待补充。
- 04
列出策略收益
各方能做什么,各结果价值如何?
输入:前一步的寻找改变收益或规则的办法的记录,以及本步需要补查的资料
本步产出:收益表
收益表说明了对象、范围与判断标准吗?能否从实际变化识别是否达成?
- 05
检查单边改变
在他人不变时谁有动力换策略?
输入:前一步的收益表,以及本步需要补查的资料
本步产出:最佳反应
最佳反应是否说明预期观察、允许的代价与停止条件?未知负责人和时间保留待补充。
- 06
寻找规则改变
什么机制能改善共同结果?
输入:前一步的最佳反应,以及本步需要补查的资料
本步产出:规则方案
回看失效条件:现实参与者未必完全理性,信息和重复互动也会改变结论。这次实践是否仍有这一风险?
把道理放回真实情景。
两个部门都保留大量缓冲时间,自行缩短会吃亏;需要统一交接承诺和异常责任。 写出双方可选动作和各自收益,再检查在别人不变时是否还有单方改进空间。均衡可能低效,需要另用规则设计讨论如何改变结果。 实际使用时先按“列出参与者与策略”保存基线,再记录“寻找规则改变”得到的结果;若结果没有改变,应回看现实参与者未必完全理性,信息和重复互动也会改变结论。
室友都等别人打扫,轮值和共同约定能改变等待的收益。 双方都等待对方先做家务可能是稳定但不满意的局面;明确分工可以改变收益和预期,而不只要求更有善意。 实际使用时先按“列出参与者与策略”保存基线,再记录“寻找规则改变”得到的结果;若结果没有改变,应回看现实参与者未必完全理性,信息和重复互动也会改变结论。
也要知道它的边界。
现实参与者未必完全理性,信息和重复互动也会改变结论。
反例与失效情形
双方都陷入低效价格战可以是稳定状态,稳定不等于值得维持。
慢下来,把问题想清楚。
先独立作答,再让 AI 检查。每个问题是一份独立实践,可以停下来,下次继续。
正在读取私人记录…
来源与延伸阅读
查看用户提供的原始摘录
原文保留用于对照;其中人物归属、科学表述和案例数据未全部核实。上方正文已对明显误用作说明。
指任何一方在选择策略时都没有共谋,而是从自身最有利的方向考虑,不考虑社会福利与对手利益。这个策略组合由每个局中人的最优策略组成。模型延伸,可以产生的思考: - 从世界的角度,发展动力如果是单独的个体与组织,都会有局限性,都只能是趋近于价值最大化。 - 策略博弈是基于自身利益的理性判断,是点式的,不是线条的,因为大多时候,人们都在用感性判断。 - 人类的发展,就是趋近整体理性的过程,虽然极度缓慢,但未来的趋势就是超越个体的局限性。 - 在淘金的路上,赚的最多的往往不是挖金子的人,而是卖水的人。反本能,往往更有效。