☰
动态博弈中的威胁与承诺:从逆向归纳到可信机制
2026/10/6 13:20:18 网站建设 项目流程

1. 跨过静态博弈这道坎:动态博弈到底新在哪里

学博弈论的人,最初接触的大多是静态博弈,比如囚徒困境:两个人同时决定是否坦白,大家一次性出招,然后结算收益。这种模型当然有用,但它有一个非常反直觉的隐含假设——所有人都在同一时刻做决策,而且做完就结束了。

可在现实里,几乎没有任何重要决策是"一次性同时完成"的。商业谈判是来回谈的:你今天报价,我明天还价,你再根据我的反应调整策略;职场博弈也一样:你先观望领导的态度,再决定要不要承担某项任务,领导也会根据你的表现调整下一步安排。真正的高手从来不是根据"对手现在会怎么做"来决策,而是根据"对手在看了我的行动之后,会怎么做"来决策。

这就是动态博弈的核心。所谓动态博弈,指的是参与人的行动有先后顺序,后行动者能观察到先行动者的选择,并据此调整自己的策略,而先行动者在做决策时,也必须把这种"对方的反应"纳入考量。

我当初刚学到这个概念时,脑子里最大的困惑是:这不就是把出招顺序从"同时"改成"先后"吗?能有本质区别?

有,而且区别非常大。因为在同时行动的静态博弈里,大家拼的是对局势的判断和对对手预期的猜测;而在动态博弈里,第一步就被切割成了两个完全不同的决策维度——你不仅要考虑自己这一步怎么走,还要预判自己这一步会引发对手的什么反应,而这个反应又反过来决定你这一步应不应该走。整个决策逻辑从"一次性利益计算"变成了"多阶段利益推演"。

更关键的是,动态博弈把博弈论中一个非常尴尬的问题摆到了台面上:很多人说要"报复"、要"惩罚"、要"合作",但这些话往往是不用付出成本的。嘴上说说谁都会,问题在于——当真正该惩罚对方的时候,惩罚者自己也要付出代价,那他还会不会兑现自己的威胁?

这个问题静态博弈基本不讨论,因为它模型中就没有"说话"这个环节。动态博弈必须直面它。经典的连锁店博弈、进入阻止博弈,全都是围绕"威胁与承诺的可信性"展开的。这也是动态博弈的入门学习中最硬核、最有意思的一块内容。

这篇文章我会顺着自己的学习笔记,把这块内容分四步捋清楚:先讲动态博弈的基本分析工具——逆向归纳;再讲威胁为什么往往不可信;然后讲承诺如何把不可信的威胁变成可信的;最后用几个经典场景把这些工具串起来。如果你是零基础,放心往下看,我会尽量用大白话和具体例子讲,不堆公式。

2. 逆向归纳:先看结局,再决定开头的招

2.1 倒着推,顺着想——动态博弈的核心分析方法

动态博弈最常见的表达方式是博弈树,也就是把所有可能的行动顺序、决策节点和收益结果画成一棵倒着长的树。根在顶,枝叶朝下,每个分支结点是一个决策节点,每条边是一个行动选择,最底部的叶子是最终收益。

分析博弈树最有效的工具,叫做逆向归纳法。思路极其简单:从博弈树的最后一个决策节点开始,看看在这个节点做决策的那个人,会选择哪些行动;把这个选择的结果带上,往前推一个节点;再看前一个节点的人会怎么选择;以此类推,一路推到根节点的初始决策。

这个方法的道理,说穿了就是一句话:**如果所有人都是理性的,那么每个人在决策时都会选择让自己收益最大的行动。**既然最后决策的人一定会选对自己最有利的选项,那这个选项就是确定的,前一个人在做决策时,就知道如果自己选择某个行动,后面会发生什么。这样一步步倒推,最终博弈的结果就确定了。

我来举个例子。现在有一件古董要拍卖,有两个买家:你和一个对手。规则有点特别:不是价高者得,而是轮流报价——你先出价,对手看到你的报价后决定跟不跟。如果你出10万,对手选择"接受",那就按10万成交,你们两人各有2万利润;如果对手选择"拒绝",那他必须以一个固定的高价买下古董,自己亏1万,而你也同样亏1万。

博弈树看起来是这样的:你报价——对手接受/拒绝——结算。从后往前分析,最后一个决策节点是"对手决定是否接受你的报价10万"。理性人当然是接受,因为接受赚2万,拒绝亏1万。所以当你站在自己的决策节点上时,你心里很清楚:只要报价10万,对手就一定会接受,自己到手2万。

如果你报价20万呢?对手依然会接受,因为接受赚1万,拒绝还是亏1万。但对你来说,报价10万比报价20万更好。于是逆向归纳得出的均衡结果就是:你报价10万,对手接受,双方各得2万。

这游戏的妙处在于,你根本没有必要"替对手担心"。对手的决策一定是理性的,你只要预判理性结果就好。逆向归纳本质上就是把"我将会怎么做、对手将会怎么做"这种循环往复的猜测问题,转化成了从终点倒推的直线问题,破除了动态博弈中的无限套娃困境。

2.2 逆推的前提:共同知识与理性假设

逆向归纳法虽然简单,但它的有效性建立在一个隐藏前提上:共同知识。这个词的意思是,不仅我自己知道某个信息,我也知道对手知道某个信息,我还知道对手知道我知道某个信息,如此无穷递归。

放在刚才那个例子里,就是:我知道对手是理性的,对手知道我知道他是理性的,我也知道对手知道我知道他是理性的……只有在信息完全透明、大家的理性水平都处于同一层次时,逆向归纳结果才是必然的。

为什么非要提这个?因为在现实博弈中,"对手不够理性"本身就是一种变数。见过不少人打牌的时候,明明算不清概率就瞎跟牌,但恰恰因为他的乱来,你基于理性推理的防守策略反而会被破解。这种情况叫做"打破共同知识假设",在实际谈判、竞标中经常发生。

所以我在学习笔记里给自己特别标注了一句话:逆向归纳是一种规范性的分析方法,它告诉我们的是"如果参与双方都足够理性,结果应该是什么";但如果对手不按套路出牌,这套方法就要打折扣。这也是后文讨论威胁和承诺时一个非常关键的伏笔——很多威胁之所以"不可信",恰恰是因为兑现威胁对威胁者自己不利,哪怕这个"不利"只建立在理性计算的框架内。

3. 威胁的本质:有些话,说出来就是为了吓唬人

3.1 空威胁:我说要惩罚你,但我真的不想罚

动态博弈中最常见的现象,就是参与者口头提出威胁。所谓威胁,简单说就是:如果你采取A行动,我就会采取B行动,而B行动会对你不利。

问题来了:当你在图书馆大声讲电话,邻桌的人说"你再吵我就去找管理员评理"。这是一个威胁。但如果代价是他自己必须中断学习、走一段路去办公室排队,而他又是一个特别怕麻烦的人,那么这个威胁可信吗?

理性的你只需要思考一个问题:他提出威胁之后,如果我真的继续打电话,他会不会真的去找管理员?这个问题的答案取决于:对他而言,去找管理员的成本,是否高于他忍受噪音的成本?如果找管理员会让他损失一个小时的学习时间,而忍受噪音只是损失十分钟的专注,那么他嘴上说的威胁,实际上是在撒谎——他根本不会去。

这就是空威胁。它是动态博弈里最典型的骗术:**威胁者故意宣称自己会采取某种行动,但这个行动如果真的执行,会对威胁者自己造成更大的伤害,因此理性人绝不会真的执行。**听的人只要稍微动脑子算一下对方的成本收益,就能轻易识破这种威胁是空的。

但有意思的是,空威胁尽管是"假的",在现实中却经常奏效。原因在于:被威胁者往往不会仔细去算威胁者兑现威胁的代价。听到"你再这样我就报警""你再涨价我就换供应商",很多人的第一反应是害怕后果,而不是评估对方是否承担得起后果。所以博弈论教导我们,面对威胁的第一反应不是问"他能不能这样做",而是问"他这样做的成本对他自己来说有多大"。

3.2 鸡生蛋式的警察与小偷博弈

举一个更贴近学习场景的例子吧。假设一个房间里有两个学生:甲想要睡觉,乙想要开灯学习。甲对乙说:"你要是开灯,我就砸了你的台灯。"

从纯粹物理上看,甲完全有能力砸台灯。但从博弈论的角度看,这个威胁可信吗?要看砸台灯的后果。如果砸了台灯,甲确实可以开灯睡觉了——但也必须赔偿乙一盏新台灯,还要背上一个暴力分子的名声,可能面临处分。算下来,砸台灯的代价远大于开灯睡觉的舒适感。所以甲说这句话,纯属吓唬。

乙应该怎么应对这个威胁?很简单——无视它,直接开灯。因为在甲的理性计算里,乙开灯之后,甲的最优反应是"忍着",而不是"砸台灯"。既然砸台灯不是一个理性人会做的选择,那它就只是一个空威胁。

这个例子虽然简单,但它把威胁问题讲到了一个非常核心的位置:**威胁是否可信,不取决于威胁者是否足够凶残或者态度是否足够强硬,而取决于威胁兑现之后威胁者自己的得失。**态度只是表象,成本结构才是本质。

很多人误以为"吼得越凶的人,威胁越可信"。博弈论恰恰告诉我们,吼得越凶的人,往往是因为他知道自己不可能真的兑现,所以才需要在语言上反复强调。真正可信的威胁者,不需要吼——因为一旦对手知道他有能力且有意愿兑现,警告一次就够了。

3.3 为什么空威胁依然会被提出来

如果空威胁如此容易被识破,为什么大家还是乐此不疲地使用?

原因在于信息不对称。威胁者对自己"是否真的会兑现"的意图,往往比被威胁者更清楚。威胁者知道这个威胁是空的,但被威胁者并不一定知道。如果被威胁者是一个风险厌恶型的人——也就是特别害怕坏结果、宁可信其有的人——那么空威胁依然能奏效。

这在谈判里非常常见。供应商A对采购方说:"你要是坚持压价,我就停掉给你供应的关键原料。"实际上停掉这个客户的单子对供应商的损失可能远远大于压价带来的损失,但这个威胁仍可能让采购方犹豫:万一对方是真的呢?万一停供了,我的产线要停摆,损失更大。

采购方面对这个威胁时,假如他能准确判断供应商的成本结构,他就能断定这只是虚张声势;但如果采购方做不到这一点,他就必须权衡"压价的收益"和"供应商万一真的停供的风险"。多数人在这种权衡里会倾向吃亏,因为他们对不确定性的恐惧往往压过对确定收益的追求。

这也给出了一个重要的实操建议:识别空威胁的唯一可靠方法,就是尽可能掌握对方的成本信息和收益结构。谈判桌上,谁掌握的信息更多,谁就能更准确地判断对方的话是真是假。反过来,如果你自己想提升威胁的可信度,就得在成本结构上下功夫——这就是下一章要说的承诺机制。

4. 承诺的本质:把退路堵死,让威胁不得不兑现

4.1 可信威胁的心理基础:让别人相信"你会做"

空威胁是口头说说,可信威胁则是行动派。要让一个威胁可信,最直接的办法是:**在威胁提出的时候,主动剥夺自己"选择不兑现"的自由。**一旦你让自己处于"如果对方采取了某个行动,我就不得不兑现威胁"的处境,那么这个威胁就从"空话"变成了"可信承诺"。

这个逻辑用一句话总结,叫"破釜沉舟"。

当年项羽过江后砸掉锅、凿沉船,士兵们知道退路没了,唯一的生路就是打赢,于是战斗力激增。项羽的这个行动,本质上就是在向自己的队伍传递一个可信承诺:我不会撤退,我会死战到底。他的士兵相信他,不是因为他说了什么,而是因为他的行为让"撤退"这个选项从物理上消失了。

在商业博弈里也有一个非常经典的例子:一个创业者放出话来,说自己一定要把产品做到行业第一。单说这句话,所有人都会把它当作空喊口号。但如果创业者紧接着做了一系列不可逆的投资——卖掉房子、签下对赌协议、拒绝所有收购意向——那么大家对他的"承诺"就多了一层信任。因为此时如果真的半途而废,他面临的损失会远超坚持到底的成本。

4.2 博弈论里的经典可信承诺模型

如果我们把一个动态博弈里的威胁和承诺用树形图画出来,整个逻辑会变得非常清晰。

假设一个市场里有一个垄断者A,和一家想要进入这个市场的潜在进入者B。博弈顺序是这样的:B先决定"进入"还是"不进入";如果B选择不进入,那么B有2万利润,A有8万利润,这就是现状;如果B选择进入,那么由A来应对,A可以选择"合作"(维持高价,两家共享利润)或者"打击"(压低价格,自己亏1万,B也亏1万甚至更多)。

这个博弈如果只用静态的理性人逻辑来分析,结果很简单:B进入之后,A的最优反应是"合作"——毕竟合作自己赚4万,打击自己亏1万。既然B知道A一定合作,B就会选择进入。最终均衡是"B进入、A合作"。

但现实里我们经常看到另一种局面:面对新进入者,既有的垄断者不惜亏本也要打价格战。为什么会这样?答案是:垄断者在这个单次博弈里的收益是"亏1万",但在一个更长期的博弈里,他的收益还包括"被市场上其他潜在进入者看到自己会打击的声誉"。也就是说,垄断者打的不是这一仗,而是一个多阶段博弈中的第一场战役。当他决定"无论谁来进来,我都会打击"的时候,他就等于向所有潜在进入者发布了一个威胁:敢来,我会不计成本地报复。

问题来了:这个威胁为什么可信?在单次博弈里,它不可信,因为理性A会选择合作。但在重复博弈的背景下,A可以通过一系列不可逆的行动来提升威胁的可信度——比如公开宣称"三年内不接受任何合作谈判",或者把自己的利润目标压到行业最低水平,或者投入大量产能建设,向市场释放"我有能力亏得更久"的信号。

这些行动的共同点,是让A在"兑现打击"和"不兑现打击"之间的成本对比发生变化。原本不兑现打击是理性的,但如果A已经公开宣称绝不合作、已经投入了海量沉没成本、已经把自己的后路封死,那么他如果不兑现威胁,他损失的不只是钱,还有整个声誉,以及未来几十年在这个市场上的话语权。到这一步,兑现打击反而成了他更理性的选择。

4.3 承诺的形式与常见误区

综合来看,常见的可信承诺形式有四种:

  • 单向不可逆投入:投钱投设备投时间,让自己无法轻易抽身,逼迫自己必须把事情做完。军事上的"破釜沉舟"、商业上的"提前建好产能",都属此类。
  • 合约化承诺:通过法律合同约束自己。比如对赌协议、违约金条款、公开承诺书。一旦违约,损失由第三方强制实现。
  • 声誉抵押:对自己的名誉下注。公开立誓就是这个逻辑——如果说了不做到,声誉受损,这个代价比坚持承诺更大。
  • 分步承诺:把大承诺拆成小步骤逐次兑现。每兑现一步,就相当于向对手提交一份证据,让下一步承诺的可信度水涨船高。

这里有个常见误区:很多人以为承诺就是"说得更狠、态度更坚决"。其实不是。语言层面的强硬不构成承诺,因为语言是零成本的。真正有效的承诺必须付出实实在在的沉没成本,让对方看到"你若不兑现,你会有真实损失"。

打个比方:如果有人对你说"我发誓明天早上一定早起,骗你是小狗",你不会太当真的,因为说这话的成本为零。但如果这人请了一个教练,每天早上6点准时视频打卡,而且已经预付了3000元押金,迟到一次扣500,你才会真正相信他会早起。制造可信承诺的最底层逻辑,就是"花一笔不可收回的钱,逼自己兑现未来某个行为"。

5. 把威胁与承诺放进真实场景里:几种典型博弈局

5.1 进入阻止博弈的商业版本

把第四章的进入阻止博弈放到一个具体背景里,你会看得更明白。

假设你经营一家本地咖啡馆,月利润2万元。最近有人打算在旁边开一家新的网红咖啡馆。你的第一反应是想威胁对方:"你要是开,我就搞低价团购、买一送一,让你血本无归。"

问题在于,这个威胁可信吗?对方只要算一笔账就明白:如果对方真的开店,你真的搞三天低价团购,你的损失可能比新店还大——因为你是老店,固定成本高、客源稳定,没必要自损八百。于是,对方判断你的威胁是空的,照样开店。这就是典型的"空威胁 + 理性进入者"结局。

但假如你的威胁足够可信呢?怎么做?比如你提前和房东签了一份"店铺月流水低于某一数额就要收回场地"的对赌协议,如果你真的打价格战导致收入暴跌,房东有权收回店铺,这个风险对你足够大,但反过来也让对方相信你"宁可拼个鱼死网破,也要把你赶走"。这时候,对方就要重新评估进入的风险了。你的威胁因为多了这份"自杀承诺"而变得可信,新进入者可能就真的打消了念头。

这个案例说明一个博弈论中很深刻的道理:**有时候,故意让自己陷入险境,反而是威慑对手的最佳方式,而不是尽力让自己保持安全。**一个永远不会受伤的人,说"我要和你拼命"是没人信的;只有当你把自己的安全绳剪断,站在悬崖边上对他说"你现在再靠近一步,我们一起下去",他才会真正停下脚步。

5.2 生活中的讨价还价:分蛋糕的先后手策略

动态博弈在生活中最常见的场景,是讨价还价中的"最后通牒游戏"。

规则很简单:给你和另一个人100元钱,由你先提出分配方案,对方选择接受或不接受。如果接受,按你的方案分;如果不接受,双方都拿不到钱,游戏结束。

理性分析是这样的:只要你还给对方的钱超过0元,对方都应该接受——因为接受至少能拿到一块钱,拒绝则是一毛没有。所以你的最优策略是给对方1元,自己拿99元。但现实中,绝大多数人宁可自己拿不到钱,也会拒绝"99:1"这种极度不公平的分配。这就是为什么纯粹的理论模型与现实行为总是有偏差——因为博弈论假设只考虑物质收益,而真实的人还会考虑公平、情绪和面子。

如果把这个游戏扩展到两轮谈判,那就是标准的动态博弈了。对方拒绝你的分配后,还可以对你"反向出价",但钱会缩水,比如第一轮100元、第二轮只剩50元。用逆向归纳法分析,第二轮的决策者(这时轮到你出价)会尽量把大头留给自己,只给对方留很少;对方预见到这一点,就会在第一轮接受一个他还能接受的方案,而不是等到第二轮被压得更狠。

这类博弈在商业谈判中极其常见:采购方说"你这价格不降,我就不签单",但实际上如果拖到下个月,供应商的库存成本更高。双方都在利用对时间成本和机会成本的计算,来调整自己的出价空间。谁的后手更充足、谁更能承受僵局,谁就能在动态博弈中占据优势。

5.3 为什么有些人在谈判中故意不留退路

我在学习这块内容时,最感叹的一个实际应用,是谈判中的"故意不留退路"策略。

想象两个小公司谈合并,A公司非常想要B公司的技术团队,B公司也不是非卖不可。如果A表现得太急切,B就会知道A急于成交,于是开高价;如果A表现得很冷淡,B可能觉得"算了不卖了"。

A的正解是什么?是让B相信:A并不只有一个选择——A完全可以把同样的钱投到其他地方,甚至扶植B的竞争对手。这就是"备选方案"的力量。在博弈论里,有一个专有概念叫 BATNA(Best Alternative To a Negotiated Agreement,谈判协议的最佳替代方案)。

动态博弈中,BATNA的作用本质上是改变威胁的可信度。如果A有一个强有力的备选方案,那么A说"你价再高,我就不谈了"就不再是空威胁,因为A真的有一条退路。而B知道这一点之后,他的定价空间就被压缩了。反之,如果A没有任何备选方案,说出"我不谈了"就完全不可信——B笃定A一定会回来。

所以实操层面的启发是:在进入任何长期谈判之前,先把自己的退路建好。备选方案的存在,本身就是你手里最有威慑力的一张牌。

6. 学习动态博弈时的三个认知陷阱与突破方法

6.1 陷阱一:把静态均衡直接搬到动态博弈里

初学动态博弈,最容易犯的一个错误,是习惯性地用静态博弈的思维方式来理解动态博弈。比如在进入阻止博弈中,很多人第一反应是"进入者知道在位者最优选择是合作,所以进入者一定会进入"。这个推理本身没错,但它低估了动态博弈里"行动的顺序"和"信息的传递"带来的影响。

在动态博弈中,先行动者的选择本身就在传递信息——它不仅仅是当下收益的计算结果,还是对后行动者的一个信号。先行动者打击后来的入侵者,表面上亏了钱,但他传递出的信号是"我会对每一个入侵者进行打击"。这个信号本身就有价值,它能改变市场的预期,从而减少未来挑衅的次数。

突破的方法:遇到任何一个动态博弈问题时,先画博弈树,把"行动的先后次序"和"每个节点上的决策者掌握的信息"都标出来,然后再用逆向归纳法倒推。只要坚持这个习惯,你的思考就会自然从静态切换到动态。

6.2 陷阱二:忽视承诺的成本问题

很多人理解了"承诺要可信,就要产生沉没成本"之后,容易走向另一个极端:无论什么场合,都觉得只有花大钱才能证明承诺。但现实的要点在于,承诺的成本应该是有针对性的,不是越大越好。

你的承诺成本,对应的是对手心里的不确定性。如果对手对你的决心本来就比较相信,你只需要一个小的承诺动作来推一把;如果对手完全不信你,你可能需要投入更多的沉没成本来改变他的预期。投入太多,你浪费了资源;投入太少,你又无法有效传递信号。

判断该投入多少的关键,是准确评估对方的识别能力。如果对方是一个经验丰富的谈判者,那么小打小闹的承诺根本没用,他一眼就能看穿你,需要实实在在的东西来证明;如果对方是一个新手,你只需要做出一个简单的姿态,可能就足够了。承诺是信号传递工具,不是越大越好的炫富游戏。

6.3 陷阱三:低估"声誉"作为长期承诺工具的价值

最后一个常见误区,是只把承诺看作一次性博弈里的工具,忽略了声誉在重复博弈中的作用。

声誉本质上是一个多阶段承诺机制。一个人如果一直信守承诺,他的声誉价值会积累;一旦他背弃承诺,声誉会在瞬间归零。因此在重复博弈中,声誉本身会反过来约束当事人的行为,让他"不得不"兑现承诺。我们经常说"名声比钱重要",在博弈论里,这句话是有严格含义的——声誉是一种跨时期的长期资产,它的存在会改变一个人在当前阶段的策略选择。

我自己的体会是,理解声誉的承诺价值,会帮助你在很多生活决策中做出"看似吃亏、实则聪明"的选择。比如在团队合作中,偶尔多干一点活、拒绝占小便宜,短期看你是亏的,但这些行为会积累你"讲诚信、不计较"的声誉。未来当你在团队中需要别人配合时,你的声誉就会成为你最具号召力的动态博弈筹码,让合作方相信你的承诺必然兑现。

6.4 一点学习上的实操建议

如果你和我一样,是非数学背景的博弈论自学者,建议按顺序做三件事:

  • 第一,把所有经典的动态博弈模型(进入阻止、连锁店、最后通牒、蜈蚣博弈)都手画一遍博弈树。画树的过程,就是强制自己理解顺序和信息传递的过程,比读十遍文字都管用。
  • 第二,每学完一个模型,找一个现实场景去套用。我个人的方法是看商业新闻时主动"翻译"——把新闻里的企业竞争行为抽象成博弈树,用逆向归纳法倒推一遍各方的理性策略。一开始会很吃力,但坚持两周之后,你会发现自己对商业谈判、竞争策略的理解力明显上升。
  • 第三,记录自己的判断错误。学博弈论最深的体会不是"猜对了别人的选择",而是"发现自己曾经在哪个场景里因为错误判断而吃了亏"。把这些场景记下来,复盘当时的信息和成本结构,这种反思比做一百道练习题更有效。

这套学习笔记写到这里,动态博弈、威胁与承诺的三层逻辑基本串起来了:动态博弈提供了"行动有先后、决策需预判"的分析框架;威胁是博弈者口头或行动层面的策略工具,但空威胁的泛滥让"话"变得廉价;承诺则通过制造沉没成本、捆绑声誉、斩断退路的机制,把廉价的语言变成可信的信号。理解这三者的关系,不只是一个学术游戏,它在谈判桌上、职场合作里、哪怕是家庭沟通中,都能派上实实在在的用场。下一篇笔记我准备深入到不完全信息博弈,也就是当大家互相不知道对方的底牌时,博弈又会发生什么有趣的变化。

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询