① 指標辭典——儀表板上每個數字怎麼算
操作型定義的判準:任何人依同一規則對同一資料應算出同一數字。每個定義配一個「從真實資料現算」的算例(由生成腳本自資料庫即時計算,非手填)。
設計強度(intended)
定義:每門課每「教學單元」(週次/目標/作業)為分析單位。單元層級值=該單元 KSAP 四層評定(各 0–3)之
最大值;矩陣格「課程 × 議題」=該課所有含此議題單元之層級值
加總。
算例(A38(1142 A班) × T2 同理):本班含 T2 之單元共 6 個——
| 週次 | 單元 | KSAP 評定 → 單元層級值 |
|---|
| W1 | 課程介紹 | K2 S1 A1 P1 → 取最大 2 |
| W2 | 病人行為與全人照護- | K1 S0 A1 P0 → 取最大 1 |
| W6 | 醫病關係- | K2 S1 A1 P1 → 取最大 2 |
| W7 | SDM- | K3 S2 A2 P1 → 取最大 3 |
| W11 | 重症-長期使用呼吸器病人要不要接受「氣管造口術」 | K2 S1 A2 P1 → 取最大 2 |
| W12 | 1150325靈性關懷的價值-學生版 | K2 S1 A2 P1 → 取最大 2 |
加總=
12,即 Macro 設計矩陣該格數字。
展現件數(attained)
定義:一份作業經編碼得 0–4 個碼;每碼=議題 × 原文佐證句(≤30 字)× 單一主層次。矩陣格「課程 × 議題」=該課作業中含此議題之
作業數(同一作業多碼只計一次)。
算例(A80 × T2 同理):含 T2 之作業共 461 件、覆蓋 291 位學生。其中一筆佐證句:「理解和支持病人的情感需求,是醫療工作者應具備的能力」
(去識別,confidence=high)。
議題覆蓋
定義:13 議題(12+T13)中「至少一個單元(設計面)/至少一件作業(成效面)」出現該議題者之個數。
算例(全學程現值):設計面 13/13、成效面 13/13。
KSAP 佔比
定義:成效面每碼標單一主層次(K 知識/S 技能/A 態度/P 實踐);佔比=該層碼數 ÷ 總碼數。
算例(v2 全庫):總碼數 20,681——K 823(4%)· S 643(3%)· A 19,109(92%)· P 106(1%)。
編碼信心
定義:每筆記錄帶編碼信心(high/medium/low,取該筆各碼眾數);儀表板聚合預設全計,分佈公開如下。
算例(v2 全庫 5,723 筆):high 4,901 · medium 562 · low 252(low 多為空碼記錄——判定無人文連結者)。
暴露人次(臨床實習・參與型)
定義:實習醫學生於臨床實習期間「完成」之人文相關面授/線上課程,每筆完成記錄計 1 人次;課程之人文相關性與 TMAC 議題由
課程標題經凍結判準判定(無大綱,信心一律標 title-only);科技倫理邊緣課程列觀察名單不計入。矩陣格「議題 × 年度」=該年度完成該議題相關課程之人次總和。
屬參與型暴露,不構成成效展現,與作業編碼之「展現件數」分軌呈現。
算例(現值):完成記錄共 20,660 筆(2021–2026.03),其中人文相關 5,164 人次/252 課;觀察名單 50 課未計入。
對齊 ρ(設計 vs 展現)
定義:同一門課,12 議題之「設計強度向量」與「展現件數向量」之 Spearman 等級相關(同名次取平均秩)。跨課可比的單一指標。
算例(A36):
| 議題 | 設計強度 | 展現件數 |
|---|
| T1 | 94 | 225 |
| T2 | 69 | 531 |
| T3 | 104 | 640 |
| T4 | 40 | 530 |
| T5 | 20 | 274 |
| T6 | 10 | 155 |
| T7 | 0 | 78 |
| T8 | 66 | 259 |
| T9 | 0 | 46 |
| T10 | 0 | 14 |
| T11 | 128 | 389 |
| T12 | 0 | 64 |
兩向量取秩後相關 ρ=
0.83。
② TMAC 議題給碼判準(12+T13,v2.1 凍結)
給碼當且僅當文本符合判準且能引原文佐證句;判準與排除規則凍結於編碼 prompt(TMAC12-v2.0-20260715,temperature=0)。條文依據:TMAC 醫學人文評鑑條文(2.3.0 專業素養總綱、2.3.13–2.3.17 專項條文、2.2.2.3 敘述性評估)。
| ID | 議題 | 條文依據 | 給碼判準 | 排除規則 |
|---|
| 專業素養群(TMAC 2.3.0) |
| T1 | 利他 | 2.3.0「利他」 | 以病人/他人福祉優先於自身利益之價值表述或行動意向(服務、奉獻、回饋) | 僅描述課程要求而無個人價值表述→不給 |
| T2 | 同理 | 2.3.0「同理」 | 對病人/他者處境之換位理解或情感共鳴,含疾病經驗之體察 | 僅同情語彙而無視角轉換→降信心 |
| T3 | 反思 | 2.3.0「自我反思」 | 對自身學習、情緒、價值或行為之後設覺察與批判性回顧 | 純心得流水帳→不給;身份層次反思優先 T4(可並列) |
| T4 | 專業素養與認同 | 2.3.0 傘狀總綱 | 專業身份之思索與形成(我想成為怎樣的醫師)、職業行為規範之內化(誠信、當責、界線) | 一般自我反思→T3;利他價值→T1 優先 |
| 專項議題 |
| T5 | 溝通 | 2.3.0+2.3.13 | 與病人、家屬、同事或醫事人員之溝通技巧、告知、傾聽、共享決策 | 純簡報技巧僅當連結醫病情境才給 |
| T6 | 文化 | 2.3.15+2.3.16(文化偏見) | 族群、跨文化、文化敏感度,或文化偏見之辨識與處理 | 性別相關一律給 T12;宗教信仰→T7 |
| T7 | 宗教/靈性 | 2.3.15「信仰」 | 宗教、信仰、靈性需求、生死觀對健康照護之影響 | 純文化習俗無信仰內涵→T6 |
| T8 | 倫理 | 2.3.0+2.3.17 | 倫理原則、道德判斷、知情同意、自主、利益衝突、研究倫理之辨析或應用 | 純法條引用無倫理辨析→T9 |
| T9 | 法律 | 2.3.17 法制面+2.3.14 通報義務(錨定較弱,見誠實聲明) | 醫療法規、醫糾、法律責任、通報義務之知識或應用 | 倫理原則辨析→T8 |
| T10 | 暴力與虐待 | 2.3.14 全文 | 暴力、虐待(家暴、兒虐、性侵等)之辨識、預防、通報或處置 | 性別歧視無暴力情節→T12 |
| T11 | 社會 | 2.3.0「社會責任」 | 社會責任、健康不平等、健康社會決定因素、弱勢照護、社區與公衛視角 | 個人利他行為→T1;須制度性/群體視角 |
| T12 | 性別 | 2.3.16「辨識與處理性別…偏見」 | 性別意識、性別偏見之辨識與處理、性別與健康照護(含性少數醫療處境) | 文化族群偏見→T6;性暴力→T10 |
| 2026 年版新增(115 年度兩版並行) |
| T13 | AI 應用與倫理 | 2026年版 2.2.14 及註釋(v2.1 新增) | AI/生成式 AI/演算法於醫療或學習之合理使用、倫理與法律責任、資料隱私、數據偏見、應用界限、對 AI 產出之批判評估、人機協作中專業判斷之保持 | 純技術操作無倫理素養內涵→不給;AI 法律責任純法條→T9 並列 |
v1→v2 變更:新增 T4 專業素養與認同、T12 性別(2.3.16);原「文化」議題移除性別內涵;12 議題重排——專業素養群(T1–T4)前置。既有 v1 編碼經對照表映射銜接,全量以 v2 判準重編。
④ 信度與再現性
雙模型稽核(編碼者間信度)
分層抽樣 10%(n=417),由架構完全不同之獨立第二模型(雲端 Claude)盲編,僅給產物與判準、不給原編碼:
主碼一致率 94%(至少一 TMAC 碼相符)。雲端模型作為一次性第二意見(非生產編碼器)。
×3 重跑再現性實驗
自 5,386 件重編語料
等距抽樣 200 件(確定性抽樣、無隨機),以同一凍結 prompt、temperature=0 重跑兩輪,與生產輪兩兩比對:
| 比對 | 主議題一致 | 議題有無重疊 | 碼集合完全一致 | Jaccard 平均 | KSAP 主層次一致 |
|---|
| run1-run2 | 87% | 98% | 52% | 0.81 | 93% |
| run1-run3 | 88% | 99% | 48% | 0.81 | 94% |
| run2-run3 | 93% | 99% | 56% | 0.84 | 96% |
解讀:temperature=0 降低但
不消除伺服端推論之非確定性——主議題判定穩定(87–93%)、KSAP 穩定(93–97%),浮動集中於「次要碼要給幾個」的邊界。
因此儀表板一律以「議題有無展現」聚合、不做深度計分;單件作業之次要碼應容忍浮動。
全量溯源鏈
每筆編碼記錄帶
prompt_version/
model/
coded_at 欄位;判準全文凍結於版控檔案;v1 全量編碼歸檔保存(未刪除),v1→v2 議題對照表公開於架構定義檔。設計面重編另保留每單元 v1 原碼(
framework_c_v1)供稽核。
版本歷程
| 版本 | 期間 | 內容 |
| v1 | 2026-06 ~ 07 | TMAC 10 議題;成效面 5,723 筆普查完成;10% 雙模型稽核 94% |
| v2.1 | 2026-07-21 | 新增 T13 AI 應用與倫理(2026 年版認證準則 2.2.14;115 年度兩版並行)。純增量:T1–T12 判準逐字不動;AI 關鍵詞候選子集補編(成效面 194 件中 136 件命中 T13、設計面 15 單元),凍結庫 tomato_lib_v2_1.py(TMAC13-v2.1-20260721,T=0) |
| v2.0 | 2026-07-15 凍結 07-20 全量重編 | 12 議題(+T4 專業素養與認同、+T12 性別)+判準/排除規則凍結+T=0+溯源欄位;成效面 5,723 筆、設計面 1,074 單元全量重編。其中 158 筆無文本之參與型記錄沿用 v1 碼經映射(記錄內明確標記) |