一组测量数据中,如果个别数据偏离平均值很远,那么这个(这些)数据称作"可疑值"。
如果用统计方法判断,能将"可疑值"从此组测量数据中剔除而不参与平均值的计算,那么该"可疑值"就称作"异常值(粗大误差)"。
这里介绍如何用格拉布斯法判断"可疑值"是否为"异常值"。
▲测量数据:例如测量10次(n=10),获得以下数据:8.2、5.4、14.0、7.3、4.7、9.0、6.5、10.1、7.7、6.0。
▲排列数据:将上述测量数据按从小到大的顺序排列,得到4.7、5.4、6.0、6.5、7.3、7.7、8.2、9.0、10.1、14.0。可以肯定,可疑值不是最小值就是最大值。
▲计算平均值和标准差s:=7.89;标准差s=2.704。计算时,必须将所有10个数据全部包含在内。
▲计算偏离值:平均值与最小值之差为7.89-4.7=3.19;最大值与平均值之差为14.0-7.89=6.11。
▲确定一个可疑值:比较起来,最大值与平均值之差6.11大于平均值与最小值之差3.19,因此认为最大值14.0是可疑值。