看哪些人更容易进入样本
某图书馆只在工作日上午向到馆者调查全体居民的使用需求,可能较少覆盖正在上班或上学的人。如果这些人的需求不同,调查就可能系统性偏向容易到场的群体。
偏差不是说每位回答者都在撒谎。即使所有回答都准确,进入调查的机会与研究特征相关,汇总结果仍可能偏离真正想了解的总体。
两种问题,处理方式不同
- 01随机波动
合理设计下不同样本会有差异
- 02系统遗漏
某些对象持续难以进入样本
- 03扩大数量
能改善部分精度,不能替代改进设计
先查样本怎么来,再看有多少份。
更大的样本不能自动补上遗漏
在同一时间同一地点再调查更多到馆者,能够更细致了解这个可接触群体,却不必然恢复没被覆盖的人。随机误差可能变小,系统性偏差却依然存在。
网上自愿留言也可能出现类似问题:特别满意、特别不满或更活跃的人更愿意回答。应答数量很大并不能证明不同态度的人有相同进入机会。
改进要针对产生偏差的环节
可以完善被调查对象的名单、调整接触时段,并检查哪些人没有回答。要想了解全体居民,就需要设法让平时不来图书馆的人也有机会进入调查。
报告应说明想了解谁、实际问到谁,以及还有谁被遗漏。一个百分比即使写到小数点后好几位,也不能修补“只问到了某一类人”的问题。