免费样本比例抽样分布计算器

输入值

样本比例抽样分布概述

样本比例抽样分布描述了如果我们从具有真实比例pp的总体中重复抽取大小为nn的随机样本,样本比例p^\hat{p}会如何变化。该分布是涉及比例的推断统计(包括置信区间和假设检验)的基础。

在许多科学领域——政治民意调查、医学研究、质量控制——感兴趣的参数是总体比例(p),它表示整个总体中拥有特定属性的个体比例。由于真实p很少已知,研究人员依靠样本比例(p^=x/n\hat{p} = x/n)作为估计。每个样本产生不同的p^\hat{p},这些值在多个样本中的模式构成了抽样分布。

与连续的均值抽样分布不同,样本比例是离散的,因为它统计n次试验中的成功数(例如,“是”回应)。其精确分布遵循参数为n和p的二项分布。然而,处理二项概率可能很繁琐,因此统计学家在满足一定条件时常用正态分布来近似它。

样本比例抽样分布计算器是一款通过这种正态近似进行快速概率计算的免费在线工具。你提供总体比例(p)、样本量(n)以及一个或两个边界(p₁, p₂),计算器将返回p^\hat{p}落在你指定范围内的概率:P(p1<p^<p2)P(p_1 < \hat{p} < p_2)、P(p^>p1)P(\hat{p} > p_1) 或 P(p^<p1)P(\hat{p} < p_1)。同时显示相应的z分数,以帮助你验证结果。

可靠正态近似的条件

要使正态近似准确,二项分布必须合理对称且呈钟形。标准检查涉及两个不等式:

n⋅p≥15andn⋅(1−p)≥15n \cdot p \geq 15 \quad \text{and} \quad n \cdot (1-p) \geq 15

这些要求保证至少15个预期成功和15个预期失败。当样本量较小或总体比例极接近0或1时,近似可能较差;此时计算器会提醒用户,应考虑精确二项方法。

核心公式

当近似成立时,p^\hat{p}的抽样分布近似正态,具有:

μp^=p\mu_{\hat{p}} = p σp^=p(1−p)n\sigma_{\hat{p}} = \sqrt{\frac{p(1-p)}{n}}

要计算概率,将样本比例值转换为z分数:

z=p^−pp(1−p)nz = \frac{\hat{p} - p}{\sqrt{\frac{p(1-p)}{n}}}

然后从标准正态累积分布函数获得给定z分数对应的概率。计算器会瞬时执行此转换及随后的概率计算。

如何使用样本比例抽样分布计算器

使用该工具很简单:

  1. 输入总体比例 pp。如果没有具体值,使用保守估计0.5(它产生最大的样本量需求)。
  2. 输入样本量 nn。
  3. 选择概率类型:上尾 (P(p^>p1)P(\hat{p} > p_1))、下尾 (P(p^<p1)P(\hat{p} < p_1)) 或双侧区间 (P(p1<p^<p2)P(p_1 < \hat{p} < p_2))。
  4. 输入边界值(p1p_1 和可选的 p2p_2)。

计算器立即显示概率及相应z分数,并检查是否满足正态近似条件。

分步示例:单尾概率

让我们回到政治支持率案例。假设支持者的真实比例为70% (p=0.7p = 0.7)。我们随机抽取n=500n = 500人的样本。看到至少325名支持者(即样本比例0.65或更高)的概率是多少?

  • 总体比例:p=0.7p = 0.7
  • 样本量:n=500n = 500
  • 下界:p1=325/500=0.65p_1 = 325 / 500 = 0.65
  • 所求概率:P(p^>0.65)P(\hat{p} > 0.65)

在计算器上,选择“P(p̂ > p₁)”并输入p1=0.65p_1 = 0.65。工具执行以下计算:

σp^=0.7⋅0.3500≈0.0205\sigma_{\hat{p}} = \sqrt{\frac{0.7 \cdot 0.3}{500}} \approx 0.0205 z=0.65−0.70.0205≈−2.44z = \frac{0.65 - 0.7}{0.0205} \approx -2.44 P(Z>−2.44)≈0.99265P(Z > -2.44) \approx 0.99265

因此,在真实支持率为70%的情况下,500人的样本显示支持者比例至少为65%的概率约为99.3%。这个高概率表明,在假设的p下,观察到样本比例0.65或更高是非常可能的。

分步示例:双侧区间

现在假设我们希望p^\hat{p}介于0.65和0.75之间的概率。选择选项“P(p₁ < p̂ < p₂)”并输入p1=0.65p_1 = 0.65和p2=0.75p_2 = 0.75。计算器计算两个边界的z分数,并返回它们之间正态曲线下的面积,即P(0.65<p^<0.75)P(0.65 < \hat{p} < 0.75)。

从数据中查找样本比例

处理原始数据时,样本比例计算如下:

p^=xn\hat{p} = \frac{x}{n}

其中xx是样本中拥有感兴趣特征个体的计数,nn是总样本量。该p^\hat{p}作为总体比例的点估计。

总体比例与样本比例

区分总体比例 (pp)——整个总体中成功的确切但通常未知的比例——和样本比例 (p^\hat{p})——在特定样本中观察到的比例,是十分重要的。抽样分布描述了p^\hat{p}如何围绕pp变化。如果分布对称(当样本量大且pp不太接近0或1时发生),则p^\hat{p}超过pp的概率约为50%,低于pp的概率也约为50%。这种对称性是许多推断程序的基础。

其他考虑事项

  • 尽管计算器使用正态近似,但底层精确分布是二项分布。当正态近似处于临界状态时,一些分析师会应用连续性校正(例如,将区间拓宽±0.5/n\pm 0.5/n),但该工具的默认方法对于常规使用是足够的。
  • 如果没有pp的可靠值,可以先使用样本量计算器来确定需要多大的样本才能达到所需的精度。
  • 这里介绍的概念直接扩展到构建单一比例的置信区间和检验关于比例的假设。对于均值的抽样分布,可以使用类似的正态概率计算器。
  • 样本比例抽样分布计算器可免费在线使用,是学生、教师和数据分析师快速评估样本比例结果可能性的便捷资源。

常见问题

1. 总体比例和样本比例有什么区别?

总体比例(p)是整个总体中成功的确切比例,通常未知。样本比例(p̂)是在单个样本中观察到的比例,计算为成功数除以样本量(x/n)。由于抽样变异性,样本比例会围绕总体比例波动。

2. 样本比例使用正态近似的条件是什么?

当np ≥ 15且n(1-p) ≥ 15时,正态近似被认为是有效的,这保证了至少15个预期成功和15个预期失败。如果样本量较小或p接近0或1,近似可能不可靠。

3. 如何计算样本比例超过特定值的概率?

使用样本比例抽样分布计算器:输入总体比例p、样本量n,选择'P(p̂ > p₁)',并输入阈值p₁。计算器会计算z分数和相应概率。例如,p=0.7, n=500, p₁=0.65时,得到约99.3%。

4. 样本比例的标准差是如何计算的?

标准差为σ_{p̂} = √[p(1-p)/n],其中p是总体比例,n是样本量。该值衡量抽样分布的散布程度,用于计算z分数。

使用方法

  1. 输入你的值。
  2. 结果会自动更新。
  3. 根据需要使用结果。