# 单一定性变量的表格表示与汇总统计量

> AP 统计学 · AP 统计学 2024-2026
> 来源: https://www.owlsprep.com/zh/study/ap-statistics-u10-tabular-representation-and-summary-statistics/

我们将讲解构建频数/相对频数表、定性数据的合法汇总统计量、解读表格输出，以及避免将定量统计量错误应用于非数值类别的方法，帮助你在AP考试中得分。

**先修:** [区分定性变量和定量变量](https://www.owlsprep.com/zh/study/ap-statistics-u10-categorical-vs-quantitative-variables/)

## 学习目标

- 为单变量定性数据集构建合法的频数表和相对频数表
- 计算单一定性变量的众数、比例和边缘分布
- 解读表格汇总结果，识别主导类别和响应模式
- 区分适用于非定量数据和不适用于非定量数据的汇总统计量

## 为定性数据构建频数表

结构合理的频数表可以将未分组的定性数据整理为一目了然的模式。所有唯一类别都必须明确列出，如果适用，还需要为缺失或无响应值设置单独的行。表格的最后一行必须始终显示所有计数的总和，该总和必须等于总样本量 $n$。

**绝对频数** — 落入单个指定类别中的独立观测值的原始数量

*记法:* $f_i$

*例:* 如果100名学生中有32名选择「生物学」作为最喜欢的科目，那么生物学类别的绝对频数为32。

**例题:** 一项针对40名学生的调查询问他们最喜欢的披萨配料：16人选意大利辣香肠，12人选芝士，7人选蔬菜，3人选火腿，2人未作答。构建完整的绝对频数表。

1. 将所有唯一类别列为表格行：意大利辣香肠、芝士、蔬菜、火腿、无响应
2. 为每一行分配对应的原始计数：16、12、7、3、2
3. 添加最后一个总计行，对所有计数求和，确认其等于总样本量40

**概念自测**

1. 合法表格中所有绝对频数的总和应该等于什么值？

   - 0.5
   - 1.0
   - 总样本量 $n$
   - 类别数量

   *解析:* 所有原始计数相加后必须等于数据集中的总观测值数量。

## 相对频数与比例计算

相对频数表将原始计数转换为比例值，便于比较不同规模的数据集。除非题目指定了其他精度要求，否则在AP考试作答中所有相对频数都应保留2-3位小数。

$$p_i = \frac{f_i}{n}$$

> **四舍五入调整技巧**
>
> 如果四舍五入导致所有相对频数的总和略高于或低于1.0，请调整最后一个类别的值，强制总和恰好等于1.0，避免丢失步骤分。

**例题:** 使用上一个示例中的披萨配料调查数据，计算每个类别的相对频数并构建完整的相对频数表。

1. 将每个绝对频数值除以总样本量 $n=40$
2. 计算各个比例：意大利辣香肠 = 16/40 = 0.4，芝士 = 12/40 = 0.3，蔬菜 =7/40=0.175，火腿=3/40=0.075，无响应=2/40=0.05
3. 对所有比例求和，确认总和恰好等于1.0

## 单一定性变量的合法汇总统计量

没有固有顺序的名义定性变量仅支持少量合法的汇总统计量。即使类别用数字标记，你也不能为名义数据计算均值、中位数或标准差。

**定性数据的众数** — 对应最高绝对或相对频数值的类别标签。如果两个或多个类别具有相同的最大计数，则可以存在多个众数。

**考试命令词**

AP考试题目针对定性汇总统计量使用特定的指令术语：

- **Calculate proportion** — 你必须展示原始计数除以总样本量的计算过程，不能仅给出最终值

- **Identify the mode** — 你必须说明类别标签，而不是数值频数值

**例题:** 200名受访者的汽车颜色偏好表格显示：45人偏好红色，62人偏好黑色，51人偏好白色，28人偏好银色，14人偏好蓝色。识别众数并计算偏好白色汽车的受访者比例。

1. 比较所有频数值找到最大值：62名受访者选择黑色，因此众数为「黑色」。
2. 将白色汽车的计数除以总样本量：51 / 200 = 0.255
3. 清晰说明两个最终值，以获得AP考试的全部分数。

## 针对AP考试作答解读表格汇总结果

当要求你从表格中描述定性分布时，你必须引用众数的相对频数，注意计数极低的类别，并明确说明是否存在多峰模式。

> **常见考试错误**
>
> 永远不要描述定性分布的「形状」：对称或偏斜等形状描述仅适用于定量数据分布。

**概念自测**

1. 以下哪一项是对宠物所有权定性分布的合法汇总？

   - 该分布呈右偏
   - 众数为「狗」，相对频数为0.45
   - 宠物类型的中位数为「猫」
   - 宠物的平均数量为1.2

   *解析:* 对于该名义定性变量，只有众数和相对比例是合法的描述性统计量。

## 常见错误

- **错误做法:** 为带有数值标签的定性数据计算均值
  - 原因: 均值要求定距/定比尺度，定性标签是没有数学意义的任意值
  - 正确做法: 改用众数或相对比例作为集中趋势度量
- **错误做法:** 忘记将相对频数求和至1.0
  - 原因: 未处理的四舍五入误差会导致总和大于1或小于1，使你丢失步骤分
  - 正确做法: 调整最后一个四舍五入后的值，确保总和恰好等于1.0
- **错误做法:** 在表格中忽略无响应类别
  - 原因: 未被统计的缺失数据会使比例估计产生偏差，导致推断错误
  - 正确做法: 在表格中添加单独的「无响应」行，覆盖所有观测值
- **错误做法:** 混淆原始频数计数和相对比例
  - 原因: AP考试题目会明确要求比例，提交原始计数将导致该部分得0分
  - 正确做法: 作答前务必确认题目要求的是绝对计数还是相对值
- **错误做法:** 为名义定性数据报告中位数
  - 原因: 中位数要求有序、可排序的类别，而名义数据不具备该属性
  - 正确做法: 仅当你明确证明排序顺序合理时，才可以将中位数用于有序定性变量

## 速查表

| 统计量 / 输出 | 适用于名义定性数据 | 公式 |
| --- | --- | --- |
| 绝对频数 | 是 | 组内观测值的原始计数 |
| 相对频数 | 是 | $f_i / n$ |
| 众数 | 是 | 拥有最大 $f_i$ 的类别 |
| 中位数 | 否（仅适用于有序定性数据） | 排序后的中间值 |
| 均值 | 否 | 所有值的总和除以 $n$ |

## 下一步

掌握单一定性变量的表格汇总技能是你后续分析双变量定性数据列联表的基础，列联表是AP考试中占比很高的考点，几乎在每一次自由作答部分都会出现。你还将应用这些频数计算流程来创建条形图和饼图，它们是单变量定性数据的标准可视化表示，经常在AP考试中与表格题目搭配出现。该技能集也直接为你后续学习包括卡方拟合优度检验在内的推断方法做准备，这类方法将观测频数作为核心输入数据。请务必练习识别定性数据的非法汇总统计量，避免在选择题中丢失简单分数。

---

来自 [OwlsPrep](https://www.owlsprep.com) —— A-Level / IB / AP / IGCSE 免费学习指南，依据官方考纲编写。原页面：https://www.owlsprep.com/zh/study/ap-statistics-u10-tabular-representation-and-summary-statistics/
