# 寡头垄断与博弈论

> AP 微观经济学 · 第4单元：不完全竞争
> 来源: https://www.owlsprep.com/zh/study/ap-microeconomics-u4-oligopoly-and-game-theory/

本模块讲解AP微观经济学第4单元的核心寡头垄断概念、市场集中度测量、同时行动与序贯博弈的博弈论框架，以及卡特尔不稳定性、进入阻遏等应用。

**先修:** 所有企业适用的利润最大化规则MR = MC; 完全竞争与垄断市场结果的差异

## 学习目标

- 计算集中度比率和赫芬达尔-赫希曼指数（HHI）以识别高集中度市场
- 在同时行动博弈中识别占优策略和纳什均衡
- 使用囚徒困境框架解释卡特尔的不稳定性
- 使用逆向归纳法求解进入阻遏问题中的序贯博弈

## 寡头垄断的核心定义

寡头垄断是一种由少数大型、策略相互依存的企业构成的市场结构，高进入壁垒阻止新竞争者进入市场。不同于完全竞争（企业是价格接受者）或垄断（市场仅存在一家企业），寡头企业在设定价格、产量、广告或其他策略选择时，必须考虑竞争对手的行动。博弈论是经济学家用来对这种相互依存的决策建模的正式框架，可预测企业会选择的结果，并将其与社会最优结果比较。

寡头垄断与博弈论约占AP微观经济学考试总分的4%，考题会同时出现在选择题（MCQ）和自由作答题（FRQ）部分。考试的标准惯例是：收益矩阵中先行列出行参与者的收益，随后列出列参与者的收益。

## 市场集中度的测量

为了将市场归类为寡头垄断，经济学家首先会测量最大企业控制了多少市场份额。AP考试考查的两种标准测量指标是四企业集中度比率（CR4）和赫芬达尔-赫希曼指数（HHI）。

**四企业集中度比率** — 市场中规模最大的四家企业的市场份额百分比之和

*记法:* CR_4

*例:* 范围从0（完全竞争）到100（前四家企业控制整个市场）

$$CR_4 = s_1 + s_2 + s_3 + s_4$$

CR4的主要局限性在于，它无法区分「一家超大型企业加三家小型企业」和「四家规模相当的大型企业」这两种市场，即使这两个市场的市场势力水平差异很大。

**赫芬达尔-赫希曼指数** — 市场中所有企业市场份额百分比的平方和，通过给大型企业额外权重解决了CR4的局限性

*记法:* HHI

*例:* 纯垄断的HHI = $100^2 = 10000$

$$\text{HHI} = \sum_{i=1}^n s_i^2$$

AP考试的标准阈值是：HHI高于2500表明市场是高度集中（寡头垄断）市场。

**例题:** 假设某州精酿啤酒市场共有5家企业，市场份额分别为：35%、30%、20%、10%、5%。计算(i)四企业集中度比率，(ii)HHI，(iii)说明该市场是否为高度集中市场。

1. 找出四家最大企业，对其市场份额求和：
2. $$35 + 30 + 20 + 10 = 95$$
3. 计算HHI：对每家企业的市场份额平方后求和：
4. $$35^2 + 30^2 + 20^2 + 10^2 + 5^2 = 1225 + 900 + 400 + 100 + 25 = 2650$$
5. 与AP考试阈值对比：2650 > 2500，因此该市场是高度集中市场。

> **考试提示:** 如果市场份额以小数形式给出（例如0.35而非35），请将平方小数之和乘以10000，得到符合AP考试阈值标准的百分比型HHI。

## 占优策略与纳什均衡

博弈论对参与者（寡头企业）之间的策略互动建模：参与者选择策略（例如定高价、加大广告投放），并根据所有参与者的选择组合获得收益（通常是利润）。同时行动博弈中两个参与者同时选择，最常用收益矩阵表示。

**占优策略** — 无论另一个参与者选择什么策略，该策略都能给参与者带来比其他任何策略更高的收益。如果两个参与者都有占优策略，最终结果就是占优策略均衡。

**纳什均衡** — 一组策略组合，给定另一个参与者正在使用的策略，没有参与者能通过改变自己的策略提高自身收益。所有占优策略均衡都是纳什均衡，但并非所有纳什均衡都存在占优策略。

最优反应法是寻找这些结果最简单的方法：对对手的每一种可能选择，标记出己方参与者的最高收益。如果某一策略在对手所有选择下都被标记，那它就是占优策略。任何两个收益都被标记的单元格就是纳什均衡。

|  | B: Downtown | B: Beach |
| --- | --- | --- |
| A: Downtown | ($120, $80) | ($200, $150) |
| A: Beach | ($180, $160) | ($100, $90) |

**例题:** 两家餐车，墨西哥卷餐车A（行参与者）和餐车B（列参与者），选择停在市中心或是海滩。收益先列出A的日利润，再列出B的。有没有参与者存在占优策略？纳什均衡是什么？

1. 找出A的最优反应：如果B停在市中心，A在市中心赚120美元，在海滩赚180美元 → 最优反应是海滩。如果B停在海滩，A在市中心赚200美元，在海滩赚100美元 → 最优反应是市中心。
2. A没有占优策略，因为A的最优选择完全取决于B的选择。
3. 找出B的最优反应：如果A停在市中心，B在市中心赚80美元，在海滩赚150美元 → 最优反应是海滩。如果A停在海滩，B在市中心赚160美元，在海滩赚90美元 → 最优反应是市中心。
4. B也没有占优策略。
5. 检查两个收益都是最优反应的单元格：(A Downtown, B Beach) 和 (A Beach, B Downtown) 都满足条件。
6. 最终结果：存在两个不同的纳什均衡。

> **考试提示:** 在FRQ答题过程中，请务必明确标出最优反应。即使你最终的均衡结果错了，只要方法正确，AP阅卷老师也会给方法部分的分数。

## 合谋、卡特尔与囚徒困境

合谋是寡头企业之间达成的协议，目的是限制产量、抬高价格，像单一垄断者一样最大化行业总利润，再在成员之间分配利润。正式的合谋协议称为卡特尔；隐性合谋是协调价格的非正式不成文协议。合谋在大多数发达国家都是非法的，其内在不稳定性是AP考试的核心考点。

囚徒困境是解释卡特尔几乎总是不稳定的经典博弈。在囚徒困境中，两家企业都有违反合谋协议的占优策略（通过降价或增加产量夺取更多市场份额），最终得到的均衡中，两家企业的利润都低于都遵守协议时的利润。作弊的个体激励压倒了合作的集体收益，因此除非卡特尔有惩罚作弊的方法，否则必然解体。在企业长期互动的重复博弈中，以牙还牙这类策略可以长期维持合谋。

|  | ConstructInc: Comply | ConstructInc: Cheat |
| --- | --- | --- |
| BuildCo: Comply | ($12, $12) | ($4, $15) |
| BuildCo: Cheat | ($15, $4) | ($7, $7) |

**例题:** 两家建筑公司BuildCo和ConstructInc合谋分割本地市场的合同。两家都可以选择遵守协议（拒绝额外合同以维持高价）或是作弊（接受额外合同，挖走对方的客户）。收益格式为（BuildCo年利润，ConstructInc年利润，单位：百万美元）。合谋结果是什么？均衡结果是什么？为什么这是囚徒困境？

1. 合谋（合作）结果是两家企业都遵守协议，每家赚1200万美元，高于均衡时两家的利润。
2. 检查占优策略：对BuildCo而言，如果ConstructInc遵守协议：1500万（作弊）> 1200万（遵守）；如果ConstructInc作弊：700万（作弊）> 400万（遵守）。作弊是BuildCo的占优策略。
3. 同理，作弊也是ConstructInc的占优策略。
4. 均衡结果是两家企业都作弊，每家赚700万美元。
5. 这是囚徒困境，因为均衡结果（两家都作弊，每家700万）对两家企业而言都差于合作结果（两家都遵守，每家1200万）。个体激励阻止了它们达到对双方都更好的结果。

> **考试提示:** 当被问及卡特尔为什么不稳定时，请务必明确提到企业违反合谋协议的个体激励。这是AP阅卷老师寻找的核心要点，不要只说一句笼统的「卡特尔会解体」。

## 序贯博弈与进入阻遏

序贯博弈是指一个参与者先行动，第二个参与者观察到第一个行动后再选择自己策略的博弈。寡头垄断中常见的应用是进入阻遏：现有企业（已在市场中的企业）先行动，潜在进入者观察到现有企业的选择后，再决定是否进入市场。

求解序贯博弈我们使用逆向归纳法：从最后行动者的选择开始，找出每一种第一个行动可能下的最优决策，再反向推导回第一个行动者，第一个行动者根据预期到的第二个行动者的反应，选择最大化自身收益的策略。

**例题:** 现有有线电视运营商Alpha（先行动者）可以定垄断高价，或是定低价限制价格来阻遏进入。潜在新进入者Beta（第二个行动者）观察Alpha的价格后，决定进入还是不进入。收益格式为（Alpha年利润，Beta年利润，单位：百万美元）：如果Alpha定高价：Beta进入 → (20, 5)；Beta不进入 → (40, 0)。如果Alpha定低价：Beta进入 → (5, -2)；Beta不进入 → (25, 0)。均衡结果是什么？

1. 先从第二个行动者（Beta）开始，找出Alpha每一种选择下Beta的最优选择。
2. 如果Alpha定高价：Beta进入赚500万美元，不进入赚0美元。5 > 0，因此Beta会选择进入。
3. 如果Alpha定低价：Beta进入亏200万美元，不进入赚0美元。0 > -2，因此Beta会选择不进入。
4. 反向推导回Alpha的选择。Alpha知道Beta的反应：如果Alpha选择高价，进入后Alpha赚2000万美元；如果Alpha选择低价，Beta不进入后Alpha赚2500万美元。2500万 > 2000万，因此Alpha选择低价。
5. 最终均衡：Alpha定低价限制价格，Beta不进入，收益为（2500万美元，0）。

> **考试提示:** 绝对不要从第一个行动者开始求解序贯博弈。正向推导忽略了第一个行动者可以预判第二个行动者的反应，几乎总会得到错误的均衡。请务必使用逆向归纳法。

## 常见错误

- **错误做法:** 混淆收益矩阵中收益的顺序，把列参与者的收益当成行参与者的收益。
  - 原因: 学生忘记行参与者收益先行的标准惯例，没有检查就从左到右读取矩阵。
  - 正确做法: 开始分析之前，先清楚标记矩阵：确认哪个是行参与者，哪个是列参与者，并标注「行收益先行」避免读错。
- **错误做法:** 声称所有纳什均衡都要求两个参与者都有占优策略。
  - 原因: 学生把占优策略均衡这个特殊情况和纳什均衡的一般定义混淆了。
  - 正确做法: 记住不存在占优策略的博弈仍然可以有一个或多个纳什均衡。即使没有占优策略，也要检查最优反应。
- **错误做法:** 计算HHI时直接对小数形式的市场份额平方求和，不进行缩放，得到0.285这样的结果，而不是2850。
  - 原因: 有些教材把HHI教成0到1之间的小数，但AP考试始终使用0到10000之间的百分比型HHI。
  - 正确做法: 如果市场份额以小数形式给出，将平方和乘以10000，转换为符合AP考试标准的形式。
- **错误做法:** 声称囚徒困境的结果对社会无效率，因为它对企业不利。
  - 原因: 学生把对企业的无效率和对社会的无效率混淆了。
  - 正确做法: 在价格竞争中，囚徒困境的结果（双方都作弊，价格更低）对社会而言比合谋结果更有效率，即使它对企业更差。讨论效率时一定要明确谁受益谁受损。
- **错误做法:** 说纳什均衡对两个参与者来说都是最优可能结果。
  - 原因: 学生把均衡和「最优」关联起来，忘记了囚徒困境中均衡下双方处境都更差的例子。
  - 正确做法: 记住纳什均衡仅意味着，给定对方的选择，没有参与者能单独改变自己的选择来改善自身结果。它不代表这个结果是社会最优或集体最优。

## 速查表

| 概念 | 核心规则 | AP要点 |
| --- | --- | --- |
| CR4 | 前四大企业市场份额百分比之和 | 范围0-100，不反映企业规模分布 |
| HHI | 所有企业市场份额百分比的平方和 | HHI > 2500 = 高度集中（寡头垄断），范围0-10000 |
| 占优策略 | 无论对手选择什么都是最优选择 | 如果双方都有占优策略，该结果就是均衡 |
| 纳什均衡 | 没有参与者能单独改善收益 | 可以存在多个均衡；不要求存在占优策略 |
| 囚徒困境 | 均衡结果对双方都差于合作结果 | 解释卡特尔不稳定性的核心 |
| 序贯博弈 | 使用逆向归纳法求解 | 从最后行动者开始，反向推导至第一个行动者 |

## 下一步

掌握寡头垄断与博弈论后，你就完成了AP微观经济学第4单元的核心市场结构内容。这种策略相互依存的框架是理解大多数现实市场中企业行为的基础，在AP考试的选择题和自由作答题中都经常出现。理解卡特尔不稳定性和进入阻遏也直接连接到课程后续讲解的监管政策主题。你现在可以复习相关的不完全竞争主题，通过练习题巩固学习，或是回到单元概述进行额外复习。

- [垄断竞争](https://www.owlsprep.com/zh/study/ap-microeconomics-u4-monopolistic-competition/)
- [第4单元不完全竞争概述](https://www.owlsprep.com/zh/study/ap-microeconomics-u4-overview/)
- [生产要素市场概述](https://www.owlsprep.com/zh/study/ap-microeconomics-u5-overview/)

---

来自 [OwlsPrep](https://www.owlsprep.com) —— A-Level / IB / AP / IGCSE 免费学习指南，依据官方考纲编写。原页面：https://www.owlsprep.com/zh/study/ap-microeconomics-u4-oligopoly-and-game-theory/
