看哪些人更容易进入样本

某图书馆只在工作日上午向到馆者调查全体居民的使用需求,可能较少覆盖正在上班或上学的人。如果这些人的需求不同,调查就可能系统性偏向容易到场的群体。

偏差不是说每位回答者都在撒谎。即使所有回答都准确,进入调查的机会与研究特征相关,汇总结果仍可能偏离真正想了解的总体。

一眼看懂 / 示意图

两种问题,处理方式不同

  1. 01随机波动

    合理设计下不同样本会有差异

  2. 02系统遗漏

    某些对象持续难以进入样本

  3. 03扩大数量

    能改善部分精度,不能替代改进设计

先查样本怎么来,再看有多少份。

更大的样本不能自动补上遗漏

在同一时间同一地点再调查更多到馆者,能够更细致了解这个可接触群体,却不必然恢复没被覆盖的人。随机误差可能变小,系统性偏差却依然存在。

网上自愿留言也可能出现类似问题:特别满意、特别不满或更活跃的人更愿意回答。应答数量很大并不能证明不同态度的人有相同进入机会。

改进要针对产生偏差的环节

可以完善被调查对象的名单、调整接触时段,并检查哪些人没有回答。要想了解全体居民,就需要设法让平时不来图书馆的人也有机会进入调查。

报告应说明想了解谁、实际问到谁,以及还有谁被遗漏。一个百分比即使写到小数点后好几位,也不能修补“只问到了某一类人”的问题。