免费样本量计算器

%
%

留空则使用50%(最保守估计)

输入值以计算所需样本量

当设计调查或实验时,首先会提出的实际问题之一是:“我到底需要多少回应才能获得可信的结果?” 一个统计样本量计算器通过执行样本量确定来回答这个问题,该过程基于三个关键信息——期望的误差范围、选择的置信水平和初始的比例估计。无论你是在进行市场调查、临床试验还是学术研究,使用专业的调查样本量工具可以确保收集足够的数据以得出有效结论,而不会浪费时间或金钱。

为什么正确的样本量很重要

样本量是指从总体中为研究提取的观测或数据点总数。如果样本太小,结果可能不可靠,且无法达到统计显著性。如果样本太大,则会不必要的消耗资源。正确确定的样本量能准确反映整个群体的特征,并将抽样误差降至最低。

需要了解的核心统计概念

有几个概念直接影响到所需样本量。了解它们有助于你在使用计算器之前做出明智的决定。

术语定义
总体你想要研究的全部个体或对象(例如,所有顾客、城市所有居民)。
误差范围(ME)调查结果与真实总体值之间可能的最大差异。通常表示为±2%、±3%或±5%。
置信水平真实值落在误差范围之内的概率。常用选项为90%、95%和99%。置信水平越高,结果越可靠。
标准差衡量回答分散程度的指标。在基于比例的调查中,它由估计比例导出。
研究功效(统计功效)研究在效应存在时检测出真实效应的概率。典型目标为80%或90%。

样本量计算器背后的公式

当总体非常大(实际上无限大)时,样本量确定的标准公式为:

n=Z2×p×(1−p)ME2n = \frac{Z^{2} \times p \times (1-p)}{ME^{2}}

其中:

  • ZZ – 与你的置信水平相关的z值。该工具通过自动选择正确的z值来充当置信水平计算器,但你也可以参考下表。
  • pp – 你的初始比例估计(如果之前没有信息,请使用0.5,因为它能给出最大的样本量)。
  • MEME – 以小数表示的误差范围(例如,±5%对应0.05)。
  • nn – 无限总体下的所需样本量。
置信水平常用Z值
90%1.645
95%1.96
99%2.576

如果你的目标总体是有限的(例如,公司所有员工或校园里所有学生),你必须应用有限总体校正以避免过度抽样:

nadj=n1+n−1Nn_{\text{adj}} = \frac{n}{1 + \frac{n-1}{N}}

这里NN代表总体大小。有限总体校正在群体相对较小时降低样本需求,使调查样本量更高效。

工作示例:校园餐厅调查

让我们通过一个具体场景来了解计算器如何工作。你想估计经常在校园餐厅吃午餐的学生比例。

  1. **设置误差范围:**你需要最终估计与真实值相差在±2%以内,所以ME=0.02ME = 0.02。
  2. 选择置信水平: 99% – 对应z值为2.576。
  3. **提供初始比例估计:**过去类似调查显示30%,所以p=0.3p = 0.3。
  4. 输入总体大小: 该校园有25,000名学生(有限群体)。

计算器首先应用无限总体公式:

n=(2.576)2×0.3×(0.7)(0.02)2≈3,484n = \frac{(2.576)^{2} \times 0.3 \times (0.7)}{(0.02)^{2}} \approx 3{,}484

然后应用有限总体校正:

nadj=3,4841+3,484−125,000≈3,051n_{\text{adj}} = \frac{3{,}484}{1 + \frac{3{,}484 - 1}{25{,}000}} \approx 3{,}051

所需样本量为3,051名学生。这意味着如果你调查这么多学生,可以有99%的把握确信结果在真实比例的±2%以内。如果你改为接受95%的置信水平,所需样本量会大幅下降(大约1,867),这说明了置信度与样本量之间的权衡。

影响所需样本量的因素

有几个因素会影响最终的样本量建议:

  • 总体大小 – 对于大型群体(超过10,000人),约384的样本量通常足以达到95%置信度和±5%误差范围。对于较小的总体,有限总体校正会显著降低所需数量。
  • 置信水平与误差范围 – 更高的置信度(99%对95%)和更紧的误差范围(±2%对±5%)都需要更大的样本量。该计算器还充当误差范围计算器,展示ME的变化如何影响样本量。
  • 研究功效 – 需要高功效来检测小效应的研究需要更多参与者。典型功效水平为80%或90%。
  • 总体变异性 – 总体越多样化,所需样本量越大。当你不确定比例时,使用50%(最大变异性)将产生最保守(最大)的样本。
  • 研究类型与亚组分析 – 探索性调查可能需要较少的受访者,但按年龄、性别或地区分解结果的临床试验或研究需要额外参与者,以使每个亚组具有统计意义。

选择样本量的实用指南

对于许多常见调查,100到400之间的样本量能提供可接受的精度。如果更高精度至关重要,则争取1,000或更多。超过这个范围,收益会变小,所以对大规模样本过度投入很少值得。始终根据预算、时间和可及性等现实约束来平衡你的期望精度。

辅助样本量确定的其他工具

一旦你获得了所需样本量,可以探索基于相同统计原理的其他计算器:

  • 抽样误差计算器 – 估计给定抽样设计下的预期误差。
  • 抽样分布的正态概率计算器 – 找出样本均值落在特定区间内的概率。
  • 样本比例的抽样分布计算器 – 评估在抽样计划下观察到特定比例的可能性。

这些辅助工具,与主统计样本量计算器一起,为你提供调查可靠性的完整图景,并帮助你正确解释结果。

常见问题

1. 用于计算样本量的公式是什么?

标准公式为 n = (Z² × p × (1-p)) / ME²,其中Z是置信水平对应的z值,p是估计比例,ME是误差范围。当总体有限时,应用校正:n_adj = n / (1 + (n-1)/N)。

2. 我何时应该使用有限总体校正?

当总体相对较小(通常少于10,000人)且样本量超过总体的5%-10%时使用。该校正会降低所需样本量以避免过度抽样。

3. 置信水平如何影响所需样本量?

更高的置信水平(例如99%对95%)会增加z值,从而使所需样本量变大。在相同误差范围内,你需要更多受访者才能更有把握认为结果反映了真实值。

4. 当没有先前数据时,什么是好的默认比例估计?

使用0.5(50%),因为它产生最大变异性,从而得到最大、最保守的样本量。这确保无论实际比例如何,你的样本都足够大。

使用方法

  1. 选择所需的置信水平,并以百分比形式输入误差范围。
  2. 提供估计比例(如果不确定请使用50%),并可选择输入总体大小以用于有限总体校正。
  3. 立即查看所需样本量以及计算中使用的Z值。