有个培训经理跟我讲过一件事。他们做了一场销售技巧培训,培训前发了前测问卷,培训结束发了后测问卷。结果后测平均分比前测高了 30%。他拿着这个数据去找领导汇报"培训效果显著"。
领导问了一句话:"你怎么证明这个分数提高是因为培训,而不是因为大家第二次做题更熟练了?"
他答不上来。
这就是前测后测设计中最容易被忽略的问题——你怎么知道分数变化是因为学习,而不是因为其他因素?
前测后测的基本逻辑
前测后测的逻辑很直白:培训前测一次,培训后再测一次,两次分数的差值就是学习效果。但这个逻辑成立有一个前提——前后测的分数变化只受培训影响,不受其他因素干扰。
现实中有哪些因素会干扰?
- 练习效应:同一套题做两次,第二次更熟练,分数自然偏高
- 天花板效应:前测分数已经很高了,后测没法再高,看不出变化
- 地板效应:题目太难,前测后测大家都不会,也看不出变化
- 时间间隔:前测和后测隔太久,中间可能有其他学习来源;隔太短,短期记忆还没消退
好的前测后测设计,就是把这些干扰因素控制住。
设计步骤
等价题怎么出
这是前测后测设计中最耗工的环节。等价不等于相同——两道题考同一个能力点,但用不同的情境、不同的案例、不同的干扰项。
举个例子,培训目标是"能识别有效反馈的三个要素(具体、及时、可执行)":
前测题(A套):"以下哪条反馈最符合有效反馈的三要素?A. 你做得不错,继续加油 B. 你昨天的报告第三页数据有误,建议今天下班前核对一下 C. 你的工作态度需要改进 D. 你是个很有潜力的员工"
后测题(B套):"以下哪条反馈最符合有效反馈的三要素?A. 你的方案整体不错 B. 你在客户会议上的表达很专业 C. 你今天上午给客户的邮件中,第二段的语气偏强,建议改成更中性的表述 D. 你要多注意沟通方式"
两道题考的是同一个能力点(识别三要素),但用了不同的情境和选项。学员不可能因为做过前测就在后测中"蒙对"答案。
等价题的验证方法:如果你的前测 A 套和后测 B 套真的等价,那么在没有培训的情况下,同一批人做两套题的分数应该差不多。你可以在另一组没有参加培训的人群中先验证一下——如果两组分数差异很大,说明题目不等价,需要调整。
除了选择题,还应该测什么
纯选择题的前测后测有一个局限——它只能测"知道",不能测"会做"。如果你的培训目标是技能类的(比如"能用 STAR 框架写一条有效反馈"),光出选择题不够。
建议在选择题之外加一道应用题。比如:
"请用 STAR 框架,针对以下场景写一条反馈:你的下属小明在昨天的客户提案中,数据准备充分,但时间控制超了 10 分钟,导致 Q&A 环节被压缩。"
这种题没法靠记忆或猜来得分。前测时学员可能写得东拉西扯,后测时如果能结构清晰地写出 Situation-Task-Action-Result 四个要素,那就是真实的学习效果。
应用题的评分可以用量规(rubric)——把 STAR 四个要素各设 0-2 分,总分 8 分。评分者按量规打分,减少主观偏差。
延迟后测:测保持而不是记忆
培训结束当场的后测分数高,可能只是短期记忆。真正有意义的学习是培训后一段时间仍然保持的。
延迟后测通常在培训后 4-6 周进行。用第三套等价题(C套),或者复用 A/B 套中没做过的那套。延迟后测的分数如果跟当场后测差不多——说明学习效果保持了。如果大幅下降——说明培训内容没有被内化,需要加强练习和应用环节。
延迟后测的回收率是个大问题。培训都过去一个月了,学员还有动力做题吗?一个技巧:把延迟后测包装成"能力诊断"而不是"考试"——让学员觉得这是在帮自己评估当前水平,而不是在检查他有没有记住培训内容。配合一份个性化的能力报告作为回报,回收率会高很多。
数据怎么读
前测后测的数据分析不只是"算个平均分看看涨了多少"。几个要点:
看个体差异,不只看平均分。平均分提高了 20%,但可能是一半人提高了 40%、另一半人没变化。看分数分布——如果前后测的分数分布几乎不重叠(后测的最低分都高于前测的最高分),说明培训对所有人都有效。如果重叠很大,说明培训只对部分人有效。
关注"负增长"的人。有些人后测分数比前测还低。这可能是因为猜题运气不同,也可能是培训反而让他们混淆了概念。如果负增长的比例超过 10%,需要检查培训内容是不是有歧义。
按能力维度拆开看。如果培训有 5 个能力点,可能其中 3 个提升了、2 个没变化。没变化的那些就是课程设计需要改进的地方。
🛠️ 在 FormLM 里做前测后测
从出题到数据分析,FormLM 支持完整的前测后测流程:
- 用量表字段和选择字段设计前测和后测问卷,两套题分别配置
- 用分享链接在培训前和培训后分别发送,学员无需注册即可填写
- 用Insight 前后测对比功能自动计算每位学员的得分变化(delta值)
- 用雷达图按能力维度展示前后变化,一眼看出哪个维度提升了、哪个没有
- 用AI 报告为每位学员生成个性化的学习效果报告,包含改进建议
✅ 核心要点
- 前测后测的核心前提:分数变化只受培训影响,不受练习效应等干扰
- 等价题(平行测试)是控制练习效应的关键——同能力点、不同情境、不同选项
- 前测平均分控制在 40-60% 之间,避免天花板和地板效应
- 技能类培训要加应用题,不能只出选择题
- 延迟后测(4-6周)测的是保持效果,不是记忆效果
- 数据分析要看个体差异和维度拆分,不只看平均分
