有个培训经理跟我讲过一件事。他们做了一场销售技巧培训,培训前发了前测问卷,培训结束发了后测问卷。结果后测平均分比前测高了 30%。他拿着这个数据去找领导汇报"培训效果显著"。

领导问了一句话:"你怎么证明这个分数提高是因为培训,而不是因为大家第二次做题更熟练了?"

他答不上来。

这就是前测后测设计中最容易被忽略的问题——你怎么知道分数变化是因为学习,而不是因为其他因素?

前测后测的基本逻辑

前测后测的逻辑很直白:培训前测一次,培训后再测一次,两次分数的差值就是学习效果。但这个逻辑成立有一个前提——前后测的分数变化只受培训影响,不受其他因素干扰。

现实中有哪些因素会干扰?

好的前测后测设计,就是把这些干扰因素控制住。

设计步骤

1
明确"学到了什么"的定义
不是"培训讲了什么",而是学员培训后应该能做什么。把培训目标转成可测量的能力点——比如"能识别3种常见的沟通陷阱"比"掌握沟通技巧"可测得多。
2
为每个能力点出 2 道等价题
前测用 A 套,后测用 B 套。两套题考同一个能力点,但题目不同。这叫"平行测试"——解决练习效应的核心方法。
3
控制难度和区分度
前测不要太难(地板效应),也不要太简单(天花板效应)。理想的前测平均分在 40-60% 之间——既留出了提升空间,也不至于完全不会。
4
控制时间间隔
后测在培训结束后立即做——测的是短期学习效果。如果要测长期保持效果,在 4-6 周后再做一次延迟后测。

等价题怎么出

这是前测后测设计中最耗工的环节。等价不等于相同——两道题考同一个能力点,但用不同的情境、不同的案例、不同的干扰项。

举个例子,培训目标是"能识别有效反馈的三个要素(具体、及时、可执行)":

前测题(A套):"以下哪条反馈最符合有效反馈的三要素?A. 你做得不错,继续加油 B. 你昨天的报告第三页数据有误,建议今天下班前核对一下 C. 你的工作态度需要改进 D. 你是个很有潜力的员工"

后测题(B套):"以下哪条反馈最符合有效反馈的三要素?A. 你的方案整体不错 B. 你在客户会议上的表达很专业 C. 你今天上午给客户的邮件中,第二段的语气偏强,建议改成更中性的表述 D. 你要多注意沟通方式"

两道题考的是同一个能力点(识别三要素),但用了不同的情境和选项。学员不可能因为做过前测就在后测中"蒙对"答案。

等价题的验证方法:如果你的前测 A 套和后测 B 套真的等价,那么在没有培训的情况下,同一批人做两套题的分数应该差不多。你可以在另一组没有参加培训的人群中先验证一下——如果两组分数差异很大,说明题目不等价,需要调整。

除了选择题,还应该测什么

纯选择题的前测后测有一个局限——它只能测"知道",不能测"会做"。如果你的培训目标是技能类的(比如"能用 STAR 框架写一条有效反馈"),光出选择题不够。

建议在选择题之外加一道应用题。比如:

"请用 STAR 框架,针对以下场景写一条反馈:你的下属小明在昨天的客户提案中,数据准备充分,但时间控制超了 10 分钟,导致 Q&A 环节被压缩。"

这种题没法靠记忆或猜来得分。前测时学员可能写得东拉西扯,后测时如果能结构清晰地写出 Situation-Task-Action-Result 四个要素,那就是真实的学习效果。

应用题的评分可以用量规(rubric)——把 STAR 四个要素各设 0-2 分,总分 8 分。评分者按量规打分,减少主观偏差。

延迟后测:测保持而不是记忆

培训结束当场的后测分数高,可能只是短期记忆。真正有意义的学习是培训后一段时间仍然保持的。

延迟后测通常在培训后 4-6 周进行。用第三套等价题(C套),或者复用 A/B 套中没做过的那套。延迟后测的分数如果跟当场后测差不多——说明学习效果保持了。如果大幅下降——说明培训内容没有被内化,需要加强练习和应用环节。

延迟后测的回收率是个大问题。培训都过去一个月了,学员还有动力做题吗?一个技巧:把延迟后测包装成"能力诊断"而不是"考试"——让学员觉得这是在帮自己评估当前水平,而不是在检查他有没有记住培训内容。配合一份个性化的能力报告作为回报,回收率会高很多。

数据怎么读

前测后测的数据分析不只是"算个平均分看看涨了多少"。几个要点:

看个体差异,不只看平均分。平均分提高了 20%,但可能是一半人提高了 40%、另一半人没变化。看分数分布——如果前后测的分数分布几乎不重叠(后测的最低分都高于前测的最高分),说明培训对所有人都有效。如果重叠很大,说明培训只对部分人有效。

关注"负增长"的人。有些人后测分数比前测还低。这可能是因为猜题运气不同,也可能是培训反而让他们混淆了概念。如果负增长的比例超过 10%,需要检查培训内容是不是有歧义。

按能力维度拆开看。如果培训有 5 个能力点,可能其中 3 个提升了、2 个没变化。没变化的那些就是课程设计需要改进的地方。

🛠️ 在 FormLM 里做前测后测

从出题到数据分析,FormLM 支持完整的前测后测流程:

  • 量表字段选择字段设计前测和后测问卷,两套题分别配置
  • 分享链接在培训前和培训后分别发送,学员无需注册即可填写
  • Insight 前后测对比功能自动计算每位学员的得分变化(delta值)
  • 雷达图按能力维度展示前后变化,一眼看出哪个维度提升了、哪个没有
  • AI 报告为每位学员生成个性化的学习效果报告,包含改进建议
开始搭建前测后测 →

✅ 核心要点

  • 前测后测的核心前提:分数变化只受培训影响,不受练习效应等干扰
  • 等价题(平行测试)是控制练习效应的关键——同能力点、不同情境、不同选项
  • 前测平均分控制在 40-60% 之间,避免天花板和地板效应
  • 技能类培训要加应用题,不能只出选择题
  • 延迟后测(4-6周)测的是保持效果,不是记忆效果
  • 数据分析要看个体差异和维度拆分,不只看平均分
← 上一篇:满意度问卷设计 下一篇:培训需求分析 →