评估与问卷术语库

白话定义、算例与避坑——每个词条都是起点,深度文章一键直达。

测量

李克特量表李克特量表用 4-7 个有序选项测量同意度或频率。怎么搭出能产出可靠数据的量表。

信度

克隆巴赫α系数克隆巴赫α估计一组题目是否在稳定地测同一构念。达标线、公式与它何时会骗人。 重测信度同一份测评隔段时间测两遍,看两轮分数相关性——你的测量到底有多稳,间隔取多久合适。 评分者间信度量化独立评分人之间的一致程度——一致率、κ 与 ICC,以及回到评分细则层面修不一致。 Cohen's κ 系数κ 把原始一致率里的偶然成分扣掉。公式、.61-.80 甜点区与患病率悖论。

效度

内容效度内容效度考的是覆盖面而非统计量——如何用专家评审与 CVR 证明测评覆盖了整个领域。 构念效度测量的总问题——聚敛、区分与因子结构证据,一条完整的效度论证长什么样。 准则效度同时效度与预测效度:把测评与真实结果做相关,以及哪些相关系数值得拿出来说。

基础

心理测量学心理测量学是什么——针对测验与问卷的测量理论,以及它为任何测评回答的四个问题。

题目质量

项目分析用难度与区分度在测验或问卷里找弱题——以及该亮灯的阈值。 难度与区分度题目设计里互相拉扯的两个指标——怎么把它们都留在健康区间。

进阶

因子分析因子分析揭示问卷里隐藏的维度——以及诚实结果背后的样本要求与坑。

统计

正态分布钟形曲线为什么关乎曲线给分、基准与常模——以及测评数据什么时候根本不听话。 Z 分数Z 分数把原始分换算成「距均值几个标准差」——跨量表、跨测验、跨维度可比。 T 分数T 分数把 z 换到「均值 50、SD 10」的尺子上——没有负数、等级带好读,是健康与胜任力报告的通行标准。 百分位排名百分位把分数变成位置——「好于群体里 80% 的人」——以及小样本必须绕开的坑。 标准差标准差量化分数离均值有多散——曲线、等级带、信度与基准宽度的骨架。

计分

加权计分加权计分在求和前按重要性放大每题结果——权重怎么定才站得住、怎么讲才讲得清。 反向计分反向表述的题目在求和前要把量表翻转——为什么要用它们,以及它们藏着的注意力陷阱。

设计

评分细则细则是一张评分地图——评分维度、表现等级与具体锚定句。怎么写到两个评委都不会有分歧。 胜任力模型胜任力模型把「好的领导力」拆成分等级的可观察行为——360、招聘记分卡与发展计划的脊椎。

方法

360 度反馈来自上级、同事、下属、本人与客户的多视角评分——让它停在「发展」而不是「政治」的设计规则。 培训需求分析TNA 在建课之前把能力缺口与流程缺口分开——三个层面、一个问题、以及终结拍脑袋的数据。 柯氏四级评估反应、学习、行为、结果——证明培训有效的四级阶梯,以及每一级真正需要什么。 形成性评估形成性评估在学习还来得及改变时做体检:小测、最难懂点、课中脉冲,以及那条反馈回路。 总结性评估总结性评估在教学结束后为所学盖章——试卷设计、及格线、证书,以及「经得起质疑」的规则。 基准报告如何用测评数据攒出行业基准报告——百分位、群体对照、以及那张被转引的分布图。

指标

净推荐值 NPSNPS 用一道 0-10 推荐题,拿推荐者占比减去贬损者占比——算法、那道更要紧的追问,以及它的边界。 CSAT 满意度分CSAT 用五点量表测一次具体接触的满意度——问题设计、回收时窗与报告口径怎么配才有效。 客户费力指数 CESCES 测量客户为办成一件事花了多大力气——为什么「省力」比「满意」更能预测忠诚,以及该在哪问。