焦点小组需要做多少个?2026 年实证依据
Qualitati 研究团队 · 2026-08-14 · 10 分钟阅读
简答。实证证据表明,所需的焦点小组数量比多数经验法则建议的更少。Guest、Namey 与 McKenna(2017)发现,超过 80% 的主题在两到三个焦点小组内即可被发现,90% 在三到六个小组内出现。三个小组即可覆盖全部最高频主题。请按每个细分人群规划三到六个小组,而不是按整个研究规划。
焦点小组需要做多少个?看证据,而不是行规
问五位研究者需要做多少个焦点小组,你会得到五个都很自信的答案:"三到五个"、"做到饱和为止"、"每个细分人群一个再加一个备用"。这些多数是沿袭下来的惯例,而非实测结论。而"焦点小组需要做多少个"这个问题其实已被实证检验过,答案比行规更有用。
本文梳理已发表证据的结论,解释为什么"按研究"是错误的规划单位,并给出一个决策矩阵——当利益相关方想把你的样本砍掉一半时,你可以用它来据理力争。
核心要点
- 超过 80% 的主题在两到三个焦点小组内出现;90% 在三到六个小组内出现(Guest、Namey 与 McKenna,2017)。
- 相比一对一深度访谈,焦点小组达到主题饱和所需的数据收集场次更少——达到 80% 饱和的中位数为 3 场,而访谈为 8 场(Namey 等,2016)。
- 规划单位是细分人群,而非整个研究。三个小组分别覆盖三个不同人群,等于每个人群只有一个小组,那不构成对任何人群的饱和。
- 作为反身性主题分析的停止规则,饱和本身存在争议(Braun 与 Clarke,2021)。请把它当作规划启发式,而非完备性的断言。
- 高频主题出现得早,低频主题与少数派视角则不然。如果你的研究问题关注的是边缘,基于常见主题推导的样本量计算会让你吃亏。
饱和研究究竟测量了什么
最常被引用的实证答案来自 Greg Guest、Emily Namey 与 Kevin McKenna 于 2017 年发表在 Field Methods 上的研究。他们分析了北卡罗来纳州达勒姆市关于非裔美国男性求医行为的 40 个焦点小组语料,逐一测量每增加一个小组后累计出现了多少主题。
主要结果是:完整数据集中超过 80% 的主题在两到三个小组内即可被发现,90% 在三到六个小组内出现。三个焦点小组足以识别出全部最高频主题。作者明确指出,这些数字低于许多传统建议。
Namey、Guest、McKenna 与 Chen 在 American Journal of Evaluation(2016)上发表的配套研究,在同一语料上比较了焦点小组与深度访谈的成本效率。达到 80% 饱和所需数据收集场次的中位数,焦点小组为 3 场、访谈为 8 场;达到 90% 时则分别为 5 场与 16 场。按场次计,焦点小组推进得更快——这对"访谈总是更严谨的默认选择"这一假设是一个有益的制衡。
关键的限定条件:主题频次
饱和曲线前陡后平是有原因的。多数受访者共有的主题几乎立刻就会出现。而少数人持有的主题——无障碍使用的边缘场景、只有资深用户才会提的异议、某个亚群体特有的文化框架——则位于长尾。停在三个小组的研究能可靠捕捉主流,却无法可靠捕捉边缘。
落到实操上就是:让小组数量匹配你的研究问题究竟关注人群的中心还是边缘。
为什么"按研究"是错误的规划单位
上述饱和数字是在单一、相对同质的人群内部计算出来的。它们并不允许你在三个不同市场各做三个小组,然后宣称达到了饱和。
请按细分人群规划。细分人群指任何你有理由预期讨论内容会显著不同的分组——角色、市场、司龄、产品档位、语言或照护场景。然后在每个细分人群内部套用小组数量。
Qualitati 焦点小组样本量决策矩阵
| 你的情形 | 每个细分人群的小组数 | 理由 |
| 探索性摸底;只需要主导主题 | 2–3 | 覆盖 80% 以上的主题及全部高频主题 |
| 支撑设计或战略决策的常规探索研究 | 3–4 | 在细分人群内接近 90% 的主题覆盖率 |
| 研究问题指向少数派观点、边缘场景或异议 | 5–6+ | 长尾主题需要更多小组才会浮现 |
| 跨细分人群的比较性结论("A 与 B 不同") | 每个细分人群 3+ 个,至少 2 个细分人群 | 每个细分人群只有一个小组时,无法把小组效应与人群效应分离 |
| 在群体中会抑制自我披露的敏感话题 | 重新考虑方法 | 此时一对一访谈通常优于小组 |
| 高风险、面向发表或受监管的研究 | 规划 4–6 个,并监测与报告饱和曲线 | 评审期待一个明确陈述且有证据支撑的理据 |
一个简单的测算公式:总小组数 = 细分人群数 × 每个细分人群的小组数。三个市场每个做三个小组就是九个小组,而不是三个。如果九个负担不起,诚实的做法是削减细分人群,而不是削减每个细分人群的小组数——后者会悄悄摧毁你对任何一个细分人群下结论的能力。
饱和报告清单
- 说明细分人群的定义,以及每个细分人群内实际执行了多少个小组。
- 报告新主题在第几个小组之后停止出现——而不只是断言"已达到饱和"。
- 区分编码饱和(不再出现新编码)与意义饱和(对既有编码不再产生新理解)。
- 点明只出现过一次的主题。它们是后续追踪的候选对象,而非应被丢弃的噪声。
- 如果你是因预算或排期原因停止的,就如实说明。一个明确陈述的约束条件,比一个从未被测量过的饱和断言更可信。
- 注明是否有某个小组被一两位发言者主导,这会虚高表观饱和度。
你应当了解的方法论异议
Virginia Braun 与 Victoria Clarke 在 Qualitative Research in Sport, Exercise and Health(2021)中主张,把饱和作为反身性主题分析的样本量理据在概念上是不自洽的。他们的论点是:在该传统中主题是通过诠释生成的,而不是躺在数据里等待被清点、被发现的。如果主题是建构出来的,就不存在一个固定总数可供作分母,"我们找到了 90% 的主题"因而是一种范畴错误。
这并不使 Guest 等人的数字失去价值,但它改变了你引用这些数字的方式。请把饱和证据当作规划启发式——为初始小组数量与预算提供可辩护的依据——而不是当作事后宣称分析已经完备的凭据。如果你的研究明确采用反身性主题分析,请遵循 Braun 与 Clarke 的建议,改以信息效力(information power)与研究设计来论证样本量。
Qualitati 的定位
Qualitati 是一个面向产品、UX 与客户洞察团队的 AI 用户研究平台。其中有两部分与小组数量直接相关。
第一,AI 主持的焦点小组改变了成本曲线。传统小组单场成本高昂,这正是"砍到三个吧"始终存在诱惑的原因。当增加一个小组的主持成本更低时,完整执行"细分人群 × 每个细分人群小组数"的方案就变得现实,你也就负担得起少数派主题所需的额外小组。Qualitati 的 AI 主持人会追问、引入沉默的声音、检验共识并对抗群体思维——后两点尤为重要,因为被单一声音主导的小组会产生虚假平缓的饱和曲线。
第二,ThemeLens 让饱和变得可观察,而不只是被断言。它在最多 100 份访谈记录上运行 map-reduce 主题分析,将编码映射到你的研究问题,并综合出带受访者原话锚定的主题。这让你能够查看每个主题在各小组中首次出现的时点,从而报告一条真实曲线,而不是一句断言。
Qualitati 支持 10 种语言的研究,并公开按 credit 计费的用量费率,因此多细分人群的方案可以在投入前先行核算成本。免费开始,赠送 30 credits,无需信用卡。
局限与不适用的场景
当话题带有污名、涉及法律敏感,或受访者有职业理由要在同行面前管理自身形象时,根本就不要使用焦点小组。群体披露规范恰恰会压抑你真正需要的材料。此时一对一访谈才是正确的工具。
不要把两到三个小组这一数字当作普适结论。它来自一份语料、一个人群、一个主题领域。同质小组讨论窄话题饱和更快;异质小组讨论宽话题饱和更慢。
不要把小组数量当作唯一的质量杠杆。六个使用诱导性讨论提纲的糟糕小组,产出不如三个主持得当的小组。样本量无法挽救工具设计上的缺陷。
最后,如果你使用 AI 主持或 AI 辅助分析,请在主题建构环节保留人工把关。自动主题抽取是很强的第一遍,却是很差的最终裁决者——尤其是对那些促使你多做几个小组的低频主题而言。
常见问题
典型的 UX 研究需要做多少个焦点小组?
每个明确的细分人群做三到四个小组,是探索性研究可辩护的默认值。依据 Guest、Namey 与 McKenna 2017 年的发现,这一区间在细分人群内接近 90% 的主题覆盖率,同时仍在可承受范围内。
三个焦点小组真的够吗?
在单一同质细分人群内,三个小组能可靠地呈现最高频主题。但如果你需要少数派视角、需要跨细分人群比较,或你的人群本身异质,那就不够。
每个焦点小组应该有多少人?
惯例做法是六到八位受访者,以在人均发言时长与视角广度之间取得平衡。这是一种惯例,而非实证推导出的最优值;面向专业或专家人群时,更小的小组也很常见。
焦点小组与访谈,哪个更快达到饱和?
按数据收集场次计,是焦点小组。Namey 及其同事(2016)在同一语料上报告,达到 80% 饱和的中位数为 3 个焦点小组对 8 个访谈。若按受访者人数计,这一比较对小组则不那么有利。
我在成稿中还应该宣称达到饱和吗?
请报告证据而非断言。展示新主题何时停止出现,界定你所谓的饱和是什么,并说明你的约束条件。如果你做的是反身性主题分析,可考虑改以信息效力来论证样本量。
AI 主持的焦点小组会改变我需要的数量吗?
不会改变底层的主题涌现曲线——那是人群与话题的属性。改变的是可负担性:更低的单场成本,使你的设计所要求的完整小组数量更容易落地。
结论
焦点小组需要做多少个?按每个细分人群三到六个来规划,乘以你的细分人群数量;当研究问题关注的是少数派观点而非主流观点时,取该区间的上限。把已发表的饱和数字当作预算启发式,测量并报告你自己的主题涌现曲线,并且绝不要让"每个细分人群一个小组"冒充比较性结论。
想在不被单场成本逼着妥协的前提下多做几个小组?免费开始,赠送 30 credits,或查看透明定价。延伸阅读:焦点小组与访谈:证据怎么说、焦点小组中的主导型受访者,以及 AI 主持的焦点小组:2026 指南。
参考来源
- Guest, G., Namey, E., & McKenna, K. (2017). How Many Focus Groups Are Enough? Building an Evidence Base for Nonprobability Sample Sizes. Field Methods, 29(1). 链接
- Namey, E., Guest, G., McKenna, K., & Chen, M. (2016). Evaluating Bang for the Buck. American Journal of Evaluation. 链接
- Braun, V., & Clarke, V. (2021). To saturate or not to saturate? Qualitative Research in Sport, Exercise and Health, 13(2). 链接
- Gandy, K. (2024). How many interviews or focus groups are enough? Evaluation Journal of Australasia. 链接
最后更新:2026 年 8 月 14 日。本文是对公开研究的独立编辑性综述;引用前请对照原始论文核实关于具体研究的方法论表述。