FormLM
模板库
学院
FAQ
关于
登录
评估与问卷术语库
白话定义、算例与避坑——每个词条都是起点,深度文章一键直达。
测量
李克特量表
李克特量表用 4-7 个有序选项测量同意度或频率。怎么搭出能产出可靠数据的量表。
信度
克隆巴赫α系数
克隆巴赫α估计一组题目是否在稳定地测同一构念。达标线、公式与它何时会骗人。
重测信度
同一份测评隔段时间测两遍,看两轮分数相关性——你的测量到底有多稳,间隔取多久合适。
评分者间信度
量化独立评分人之间的一致程度——一致率、κ 与 ICC,以及回到评分细则层面修不一致。
Cohen's κ 系数
κ 把原始一致率里的偶然成分扣掉。公式、.61-.80 甜点区与患病率悖论。
效度
内容效度
内容效度考的是覆盖面而非统计量——如何用专家评审与 CVR 证明测评覆盖了整个领域。
构念效度
测量的总问题——聚敛、区分与因子结构证据,一条完整的效度论证长什么样。
准则效度
同时效度与预测效度:把测评与真实结果做相关,以及哪些相关系数值得拿出来说。
基础
心理测量学
心理测量学是什么——针对测验与问卷的测量理论,以及它为任何测评回答的四个问题。
题目质量
项目分析
用难度与区分度在测验或问卷里找弱题——以及该亮灯的阈值。
难度与区分度
题目设计里互相拉扯的两个指标——怎么把它们都留在健康区间。
进阶
因子分析
因子分析揭示问卷里隐藏的维度——以及诚实结果背后的样本要求与坑。
统计
正态分布
钟形曲线为什么关乎曲线给分、基准与常模——以及测评数据什么时候根本不听话。
Z 分数
Z 分数把原始分换算成「距均值几个标准差」——跨量表、跨测验、跨维度可比。
T 分数
T 分数把 z 换到「均值 50、SD 10」的尺子上——没有负数、等级带好读,是健康与胜任力报告的通行标准。
百分位排名
百分位把分数变成位置——「好于群体里 80% 的人」——以及小样本必须绕开的坑。
标准差
标准差量化分数离均值有多散——曲线、等级带、信度与基准宽度的骨架。
计分
加权计分
加权计分在求和前按重要性放大每题结果——权重怎么定才站得住、怎么讲才讲得清。
反向计分
反向表述的题目在求和前要把量表翻转——为什么要用它们,以及它们藏着的注意力陷阱。
设计
评分细则
细则是一张评分地图——评分维度、表现等级与具体锚定句。怎么写到两个评委都不会有分歧。
胜任力模型
胜任力模型把「好的领导力」拆成分等级的可观察行为——360、招聘记分卡与发展计划的脊椎。
方法
360 度反馈
来自上级、同事、下属、本人与客户的多视角评分——让它停在「发展」而不是「政治」的设计规则。
培训需求分析
TNA 在建课之前把能力缺口与流程缺口分开——三个层面、一个问题、以及终结拍脑袋的数据。
柯氏四级评估
反应、学习、行为、结果——证明培训有效的四级阶梯,以及每一级真正需要什么。
形成性评估
形成性评估在学习还来得及改变时做体检:小测、最难懂点、课中脉冲,以及那条反馈回路。
总结性评估
总结性评估在教学结束后为所学盖章——试卷设计、及格线、证书,以及「经得起质疑」的规则。
基准报告
如何用测评数据攒出行业基准报告——百分位、群体对照、以及那张被转引的分布图。
指标
净推荐值 NPS
NPS 用一道 0-10 推荐题,拿推荐者占比减去贬损者占比——算法、那道更要紧的追问,以及它的边界。
CSAT 满意度分
CSAT 用五点量表测一次具体接触的满意度——问题设计、回收时窗与报告口径怎么配才有效。
客户费力指数 CES
CES 测量客户为办成一件事花了多大力气——为什么「省力」比「满意」更能预测忠诚,以及该在哪问。