FormLM
範本庫
學院
FAQ
關於
登入
評估與問卷術語庫
白話定義、算例與避坑——每個詞條都是起點,深度文章一鍵直達。
測量
李克特量表
李克特量表用 4-7 個有序選項測量同意度或頻率。怎麼搭出能產出可靠資料的量表。
信度
克隆巴赫α係數
克隆巴赫α估計一組題目是否在穩定地測同一構念。達標線、公式與它何時會騙人。
重測信度
同一份測評隔段時間測兩遍,看兩輪分數相關性——你的測量到底有多穩,間隔取多久合適。
評分者間信度
量化獨立評分人之間的一致程度——一致率、κ 與 ICC,以及回到評分細則層面修不一致。
Cohen's κ 係數
κ 把原始一致率裡的偶然成分扣掉。公式、.61-.80 甜點區與患病率悖論。
效度
內容效度
內容效度考的是覆蓋面而非統計量——如何用專家評審與 CVR 證明測評覆蓋了整個領域。
構念效度
測量的總問題——聚斂、區分與因子結構證據,一條完整的效度論證長什麼樣。
準則效度
同時效度與預測效度:把測評與真實結果做相關,以及哪些相關係數值得拿出來說。
基礎
心理測量學
心理測量學是什麼——針對測驗與問卷的測量理論,以及它為任何測評回答的四個問題。
題目質量
專案分析
用難度與區分度在測驗或問卷裡找弱題——以及該亮燈的閾值。
難度與區分度
題目設計裡互相拉扯的兩個指標——怎麼把它們都留在健康區間。
進階
因子分析
因子分析揭示問卷裡隱藏的維度——以及誠實結果背後的樣本要求與坑。
統計
正態分佈
鐘形曲線為什麼關乎曲線給分、基準與常模——以及測評資料什麼時候根本不聽話。
Z 分數
Z 分數把原始分換算成「距均值幾個標準差」——跨量表、跨測驗、跨維度可比。
T 分數
T 分數把 z 換到「均值 50、SD 10」的尺子上——沒有負數、等級帶好讀,是健康與勝任力報告的通行標準。
百分位排名
百分位把分數變成位置——「好於群體裡 80% 的人」——以及小樣本必須繞開的坑。
標準差
標準差量化分數離均值有多散——曲線、等級帶、信度與基準寬度的骨架。
計分
加權計分
加權計分在求和前按重要性放大每題結果——權重怎麼定才站得住、怎麼講才講得清。
反向計分
反向表述的題目在求和前要把量表翻轉——為什麼要用它們,以及它們藏著的注意力陷阱。
設計
評分細則
細則是一張評分地圖——評分維度、表現等級與具體錨定句。怎麼寫到兩個評委都不會有分歧。
勝任力模型
勝任力模型把「好的領導力」拆成分等級的可觀察行為——360、招聘記分卡與發展計劃的脊椎。
方法
360 度回饋
來自上級、同事、下屬、本人與客戶的多視角評分——讓它停在「發展」而不是「政治」的設計規則。
培訓需求分析
TNA 在建課之前把能力缺口與流程缺口分開——三個層面、一個問題、以及終結拍腦袋的資料。
柯氏四級評估
反應、學習、行為、結果——證明培訓有效的四級階梯,以及每一級真正需要什麼。
形成性評估
形成性評估在學習還來得及改變時做體檢:小測、最難懂點、課中脈衝,以及那條回饋迴路。
總結性評估
總結性評估在教學結束後為所學蓋章——試卷設計、及格線、證書,以及「經得起質疑」的規則。
基準報告
如何用測評資料攢出行業基準報告——百分位、群體對照、以及那張被轉引的分佈圖。
指標
淨推薦值 NPS
NPS 用一道 0-10 推薦題,拿推薦者佔比減去貶損者佔比——演算法、那道更要緊的追問,以及它的邊界。
CSAT 滿意度分
CSAT 用五點量表測一次具體接觸的滿意度——問題設計、回收時窗與報告口徑怎麼配才有效。
客戶費力指數 CES
CES 測量客戶為辦成一件事花了多大力氣——為什麼「省力」比「滿意」更能預測忠誠,以及該在哪問。