博弈论
一、它到底是什么
那个位置叫纳什均衡。意思是,给定别人都这么选,你换一种选法只会更差,对每个人都是如此。均衡不保证结果好,只保证「没人能靠单方面改主意占到便宜」。囚徒困境就是最典型的例子:两个人都选了对自己最保险的那条路,合起来却落到一个谁都不满意的结局。
它还区分两类局:零和与正和。零和是我多一分你就少一分,分的是同一块蛋糕;正和是合作能把蛋糕做大,双方都能多拿。分不清这两类,是很多争执的根源。这套分析最早由冯诺依曼和摩根施特恩系统提出,后来纳什给出了均衡的严格定义,从此成了经济学、政治学和商业战略里的通用工具。
二、为什么它管用 / 为什么人会这样
因为人天然只会从「我这边」推演。你假设别人不动,自己挑最优的一步;可一旦对方也在这么做,两个人就互相踩到了对方的假设上。博弈论逼你换位:先想别人会怎么应对,再回头看自己该怎么选。
它管用的另一层原因,是逼你把模糊的直觉写成明确的东西。把参与者、可选动作、各自的收益一条条列出来,很多原本吵不清的问题会自己现形:原来我们争的不是方案,是各自算的是哪一笔账。
一个反直觉的地方:均衡不等于好结果。所有人都做了对自己最理性的选择,整体却可能一起变差。这说明「人人都聪明」并不能自动带来好结局,规则本身决定了局会走向哪里。
三、什么时候会碰到它 / 该用它
- 你的结果取决于别人的行动,而对方也在盯着你。
- 团队为下一步吵不出结论,各说各的理。
- 你想判断一次合作是能共赢,还是此消彼长。
- 谈判、定价、竞标、抢资源这类互相牵制的场合。
- 你在设计规则,想让大家的自私选择自然走向好结果。
四、什么时候它不管用
问题简单、直接做比分析更划算时;基本事实都缺、只是在概念上空转时;你只想用它给已经定好的结论披一层外衣时;代价极高、没法试错又没有别的验证手段时。还有一条:如果对方根本不按理性出牌,或者信息完全不对称,模型给出的是「理性人会怎么做」,不是「他实际会怎么做」。
五、例子
价格战
两家公司都清楚,一起维持高价最赚钱。但谁都怕对方偷偷降价抢客,于是抢先降。等双方都降到底,谁也没赢,只是把利润一起打没了。这就是囚徒困境。
谈判分账
一次合作如果只看谁多拿一块,就是零和;如果先去想能不能把合作做大、再谈怎么分,就变成了正和。很多谈判卡住,是双方都默认了这是零和。
六、最容易走偏的地方
- 把博弈论当算计别人:它是理解互动的框架,不是操纵术。
- 默认对手是理性人:现实里情绪、面子、信息差都会让行为偏离模型。
- 只算一次:真实的局会重复,这一轮的报复会变成下一轮的代价。
- 看不到正和空间:一上来就当成零和,等于提前关掉了把蛋糕做大的可能。
- 把均衡当最优:均衡只是「没人愿单方面改」,不等于「大家一起最好」。
七、怎么把它用起来
- 先列玩家:谁的选择会影响结果,谁又被谁影响,写全。
- 给每人写收益:不用精确,写清他更想要什么、更怕失去什么。
- 判断局的类型:这是零和还是正和?先定这个,再谈策略。
- 做换位推演:假设你选甲,对方最可能怎么回?你再怎么接?
- 找那个谁都不愿先动的点:它是不是你要的结局?如果不是,就去改规则。
- 设计激励:与其求别人自觉,不如让利己的选择正好通往你要的方向。
八、它和「二阶思维」不一样
博弈论关心的是多个主体之间的相互反应,重点在「他会怎么接我的招」。二阶思维关心的是一个决定之后的连锁后果,重点在「然后呢,再然后呢」。两者常一起用:先用二阶思维看清一步棋的后续,再用博弈论算出对手会如何应对、你又该怎么落子。
九、常问的几个问题
它主要解决什么?
在「别人也会行动」的前提下,帮你选一个更稳的策略。
不懂数学能用吗?
能。核心就三样:有哪些玩家、各自想要什么、谁先动谁后动。
均衡一定好吗?
不一定。它只保证没人能单方面改善,不保证对大家都好。
怎么避免囚徒困境?
常见做法是让博弈重复,今天让利换明天的信任;增加信息透明度;或者引入外部约束。
相关
囚徒困境、二阶思维、激励、零和与正和、信息不对称。
一句话收束
只想着自己怎么赢,往往赢不了;先想别人会怎么接招,才算真正开始下棋。







