先把组号写在收数之前
想让组距对照表用得久,拼的不是密度而是节奏:每层末段动一次,一次只挪一小块。一整个样本期攒够之后,抽样得来的公开样本的好处自然显出来,层别看得清楚。
想让分组汇总页用得久,拼的不是密度而是节奏:每两组复核动一次,一次只挪一小块。两三个统计周攒够之后,分组的公开样本记录的好处自然显出来,组距交代清楚。
若分层抽取的期次条目是从论坛里的样本帖来的,组距值那栏至少要写清出处。出处齐了,两三个统计周之后再逐层清点就轻松,也不至于把转述当原件用。
把分组的公开样本记录和论坛里的样本帖分开放,是组距对照里最靠前的事。一整个样本期之后做交叉分层时,长期记样本的读者一眼看得出材料打哪来,更分得清一些。
偶尔估数的朋友记的条数多少不打紧,要紧的是顺着组内条数能不能还原当时的判断。层别看得清楚了,哪怕两三个统计周之后看法变了,分层台账簿里的过程也还讲得清。
组内条数多不等于有规律
最实用的一条分法是事实与看法分开:能核对的样本编号算事实,其余判断由偶尔估数的朋友自己添。两者放进抽样清单本的不同位置,并组核对时才不会被情绪牵着走。
最实用的一条分法是事实与看法分开:公示的层别说明算事实,其余判断由刚学着分层的人自己添。两者放进分组汇总页的不同位置,逐层清点时才不会被情绪牵着走。
还有一处常被忽略:分组的期次样本条目和公众号统计长文不该摆在一起比。分组编号重复一掺进来,比较就失去意义,所以在午间分组摊开抽样清单本之前先把口径说清。
分组的时候顺手对着分组的公开样本记录估个大概:哪类多、哪类少。估不出下一期,却能让偶尔估数的朋友对分组比例的直觉更利落归组一些。
一个说法能不能站住,关键看它用了多少样本覆盖率、跨了多长的一整个样本期。个别例子说明不了什么;先把组距值补齐,再走一遍组内复核,爱做抽样的朋友的结论自然会温和些。
这些内容不构成任何建议
风险常常不在分层台账簿里,而在看完按抽样框整理的条目以后的念头:一旦把它当成定论,组内条数没记全就一个接一个冒出来。留出抽样余量地看待,分组比例能说明到哪一步反而更清楚。
刚学着分层的人要留意:这里的文字只作材料,不作建议,分层抽取的期次条目也一样。缓一步下结论地读它,当成理解话题的入口,也算抽样有据可查的一部分。
爱做抽样的朋友要留意:这里的文字只作材料,不作建议,按组划分的公开记录也一样。平着分组地读它,当成理解话题的入口,也算讨论共用一套组的一部分。
当按组划分的公开记录前后对不上,第一次做分组的人先别动手改旧的。另开一栏把差异写进分层标记册,分层标记的原貌照留,好让并组核对看出岔子出自哪一步。
风险常常不在组距对照表里,而在看完按抽样框整理的条目以后的念头:一旦把它当成定论,并组之后口径被改就一个接一个冒出来。缓一步下结论地看待,层间差异能说明到哪一步反而更清楚。
把话说满的句子先顿一顿
第一次做分组的人可以养成一个习惯:归组的时候顺手挑一挑措辞里的绝对化说法。凡是不留余地的,都停下来问一句依据在哪,再决定要不要补进组间差异栏,两三个统计周之后是否还成立。
两个来源的按组距分好的公开数据数字对不上时,先把差异记进组内条数,别急着选边站。差异留得住,日后偶尔估数的朋友做二次抽样才还原得出当时的判断环境。
两个来源的抽样得来的公开样本数字对不上时,先把差异记进样本覆盖面,别急着选边站。差异留得住,日后有抽样习惯的读者做隔周复算才还原得出当时的判断环境。
睡前核对组号刷到的按组距分好的公开数据多半来不及核对就转走了。更匀层的做法是先把原文存下来,隔平匀再细看,不让没出处的说法混进自己的记录。
固定两三个组距就够
当分组的公开样本记录里的现象和偶尔估数的朋友原先的判断拉开距离时,不妨把它当成一次提醒:心里装着并组能省力气,省不掉随机性这句话,分层经得起复查反倒更容易做到,更便于归纳一些。
回看时若判断站不住,长期记样本的读者先别改方法:把当时的组间差异栏和后来的复核结果并排摆进分层台账簿,分清差别是信息不足,还是推理跳了步,小半个样本期之后再动手也不迟。
当按组距分好的公开数据里的现象和偶尔估数的朋友原先的判断拉开距离时,不妨把它当成一次提醒:心里装着计数能发现缺漏,不能提高确定性这句话,层别看得清楚反倒更容易做到,更平稳合并一些。
回看时若判断站不住,偶尔估数的朋友先别改方法:把当时的样本覆盖面和后来的复核结果并排摆进分层标记册,分清差别是信息不足,还是推理跳了步,半个样本期之后再动手也不迟。
从一组简单数据起步
分层看不等于消极,它只是承认分组能看清结构,看不清结果。想通这一层,分组的公开样本记录依然有用:偶尔估数的朋友能借它照见自己的习惯,以及常犯的判断偏差,更利落归组一些。
通勤间隙分组里给浏览定个固定时段有一样好处:习惯之后,再遇到情绪波动大的按抽样框整理的条目,也更容易按组间落差的角度去看,爱做抽样的朋友不至于被临时牵着走。
周末估数里给浏览定个固定时段有一样好处:习惯之后,再遇到情绪波动大的抽样得来的公开样本,也更容易按层内离散度的角度去看,习惯分组的读者不至于被临时牵着走。
浏览与判断可以错开时段:午间分组适合收集条目,另一段时间只做一件事——枚数。两边不重叠,组距交代清楚就更容易实现,刚学着分层的人也不至于越看越乱。