一句话说清

博弈重复很多次,合作就成了聪明选择。

为什么值得懂

单次博弈里,坑人一把就跑是理性;重复博弈里,坑人等于断了自己的后路。阿克塞尔罗德的《合作的进化》用计算机锦标赛证明了一件反直觉的事:在长期重复的博弈里,最“傻”的以牙还牙策略,打败了所有精明算计的策略。看懂重复博弈,你就明白为什么商家不敢宰熟客、同事间会互相留面子——长期关系本身,就是最好的约束。

零基础讲解

囚徒困境讲的是单次博弈:双方都背叛才是各自的“理性”选择,结果却是双输。但现实中的交往大多是重复博弈:今天你坑了同事,明天还要见面;这次你宰了顾客,他再也不会来。重复改变了计算——背叛的短期收益不变,但要扣掉未来合作的全部损失。

阿克塞尔罗德组织了一场计算机策略锦标赛,让各种策略两两对打几百轮囚徒困境。赢家不是最精于算计的,而是一条极简单的策略“以牙还牙”:第一轮合作,之后永远复制对方上一轮的做法——你合作我就合作,你背叛我就背叛。它赢得比赛靠四个特点:一是善良,从不先背叛;二是可激怒,被背叛立刻反击,不吃哑巴亏;三是宽容,对方回头合作,马上既往不咎;四是简单,让对方一眼看懂规则。

重复博弈的启示有三条:第一,让对方知道“还有下次”,合作才划算——所以老店、熟人、长期合同更可信;第二,要让人不敢坑你,得让对方知道你会反击,一味的忍让只会鼓励背叛;第三,别做那个先背叛的人——先背叛能赚一次,但会输掉整个长期关系。当然也有例外:如果确定是最后一局,或者对方是“打一枪换一个地方”的骗子,那就别用合作的逻辑去送人头。

长期博弈靠信誉,怎么让信誉可查,《契约与信用》给的是白纸黑字。

一个例子

小区门口两家早餐店。A 家用劣质油省成本、涨价宰熟客,半年后门可罗雀;B 家分量足、老主顾常抹零,十年生意红火。A 赚的是单次博弈的钱,B 赚的是重复博弈的复利。

常见误解

  • 以为重复博弈就是“好人策略”:以牙还牙是先合作、可反击、能宽容,不是烂好人。
  • 以为忍让能换合作:没有反击能力的善良,只会被反复利用。
  • 以为背叛永远划算:单次也许划算,重复博弈里背叛是自断后路。
  • 以为所有博弈都会重复:遇到一次性交易或骗子,要切换防御策略。

应用场景

  • 职场:和长期共事的同事建立“你靠谱我也靠谱”的声誉,别做一次性的聪明人。
  • 生活:办卡、装修选有长期口碑的商家;合作前先看“还有没有下次”。
  • 创作:写对手从互相算计到长期合作,重复博弈是最好的转变逻辑。

关联知识点

  • 囚徒困境(prisoners-dilemma,重复博弈是它的“长期版”,解法完全不同)
  • 搭便车(free-rider,重复博弈里,声誉和报复机制能抑制搭便车)
  • 契约与信用(contract-trust,长期关系是信用的来源,信用又反过来维系长期关系)
  • 所属主线:信任与合作