误差线图
误差线图(error-bar plot)用一段线表示某个点估计周围的区间。单看两端的位置无法知道它表示的是原始数据的标准差、估计量的标准误、置信区间,还是仪器允许误差;必须在图注中写明对象、算法、置信水平和单位。区间的含义来自计算与假设,不来自线段的外形。
两组五次观测与两条区间
设两组独立的等候时间分别为 A: 分钟,B: 分钟。这些是合成教学数据,两组各 。样本均值为 、 分钟。先保留图中的全部原始点,再讨论要给哪个量画区间。
以 A 组为例,五个值与均值的差为 ,平方和为 。样本方差按 作分母,故 ,样本标准差 分钟。B 组只是整体加了两分钟,因此 。
若把每组的五次读数看作来自同一正态总体的独立样本,可用 区间估计该组总体均值 。标准误为 分钟;自由度为 的 分布有 。于是 两组的 95% 置信区间约为 A 的 与 B 的 分钟。图中浅色小点是原始观测,较大的彩色点是均值,竖线两端才是按上述模型计算的区间。均值为 的点与恰好为七分钟的原始点重合,但代表的对象不同。
标准差、标准误和置信区间不能互换
描述组内个体读数的离散程度; 是样本均值的估计标准误;上式再乘 分位数,才形成指定置信水平的均值区间。若只画 ,不能在图注中称它为“95% 置信区间”。反过来,均值置信区间也不是下一位参加者可能等待的范围;个体预测还包含新的个体差异,通常更宽。
95% 的频率解释对应重复采用同一种抽样与建区间方法:在模型条件成立时,长期反复得到的区间约有 95% 包含固定但未知的总体均值。它不表示已算出的这个区间内“均值有 95% 的概率”。仅五个数据点很难从图上核实正态与独立假设,故示例的区间是说明方法,不是关于真实候车系统的结论。
比较两组时计算差值区间
两条 95% 区间是否重叠,不是一条通用的显著性判据。此例若另外假设两组总体方差相同,则两个样本方差都为 ,合并方差为 两组均值差的标准误于是为 在独立正态、等方差模型下,自由度为 的双侧 95% 区间为 它包含零,表示这组小样本按该方法尚不能把总体均值差与零清楚区分。样本中的两分钟差仍是已经观察到的事实;推断结论回答的是另一个问题。若方差或抽样方式与上述假设不符,应重新选择计算方法,而不能照搬图上端点。
误差线旁应标出每组 、所画区间类型与算法,并尽量保留原始点。跨时间绘制一串区间时还须说明它们是否来自同一批对象,以及是否考虑多次比较。只给一个彩色柱和两条没有定义的“±”线,无法让读者判断图在表达变异、估计精度还是测量误差。
参考资料
- NIST/SEMATECH:均值的置信区间, 区间公式与覆盖率解释。
- ggplot2:区间图形对象,位置、下界与上界的图形表示。
- 英国国家统计局:图中表示不确定性,清楚标注区间含义与读图说明。
- 相关:统计推断、方差与标准差、箱线图、统计图形语法。