iT邦幫忙

2026 iThome 鐵人賽

DAY 5
0

如果今天改了 BE03 的題意,後面的 CFA(驗證性因素分析,把理論寫成可被資料反駁的模型)、IRT(試題反應理論)和學生學習單要不要一起改?BE03 是本系列合成示範量表 ENGAGE-v1 的一道行為投入題,第 8 天會完整介紹題本與資料;這裡先把它當成一個會被後續章節反覆使用的識別碼。一張發文日期表找不出這些影響。前四篇已訂出完成條件、先備診斷與來源紀律,今天把它們放進 Spectra(規格驅動的開發工具),保存每次修改的理由,以及哪些文章需要跟著檢查。

我在這個系列選用 Spectra 保存寫作承諾:每篇要回答什麼、什麼狀態才算完成、改動會影響誰。這是工作流程的選擇,沒有據此宣稱工具已改善教學成效。本篇把文件與操作說清楚,後續只有需求變更、驗收或內容偏離規格時再回來使用。

四份文件,各做一件事

proposal:為何值得寫、範圍是什麼
    ↓
design:30 篇如何累積、有哪些取捨
    ↓
spec:什麼狀態才算符合要求
    ↓
tasks:依賴順序、交付行為與驗證方式

這張圖的用途是區分文件責任。它不能保證文章內容正確;Spectra 只會指出我的 artifact(產出文件)是否自洽,不能判定 alpha(內部一致性信度係數)的解釋是否符合心理計量理論。學科查核仍回到來源、公式、資料與反例。

最直覺的替代方案是一張 30 列試算表。它很適合排日期與題名,但不容易表達規範句、失敗情境和任務驗證。另一個替代方案是讓 Claude 每天讀前文後自行續寫;這把一致性寄託在模型當下是否抓到正確脈絡,也沒有留下需求變更的理由。

Claude 如何把計畫轉成規格

把前四天的成果交給 Claude 時,可以要求它找出能用 MUST(規範用語)/SHALL 表達、並能以 WHEN(驗收情境用語)/THEN 驗收的規則,先不增加心理計量主張。如果候選句只寫「每篇應該有來源」「文章應該前後連貫」,就繼續問:要查看哪一列、哪份資料,才能判定它沒有做到?

我改寫成兩個可觀察例子:

  • 當 reviewer(審閱者)選取任一核心心理計量主張時,ledger(來源與主張帳本)必須提供第一手來源或可重現計算。來源要附精確的 locator(來源的精確位置);Claude 只能出現在協作欄。
  • 當 30 列 blueprint(系列藍圖)被檢查時,除 Day 1 與 Day 30 外,每篇都要有承接與交接欄位。也就是 depends-on(承接前篇的欄位)與 hands-off-to(交給下一篇的欄位)都不能缺,而且依賴圖連通。

這次 AI 的價值是快速窮舉規則候選;教師的工作是把形容詞改成可失敗的條件。沒有失敗條件的規格,在截止日前通常會被解釋成「差不多就好」。

規格變更不是偷偷改題目

本系列原本規劃前十篇完整稿、後二十篇 executable outline(大綱)。當我決定直接寫完 30 篇時,這不是多做一點而已,而是交付狀態改變。spec(規格文件)必須從「後二十篇有 outline」改為「全部文章有完整正文且 verified(已通過本系列查核)」。tasks(任務清單)也要拆出後二十篇寫作與驗證。Spectra 的 ingest(需求變更納入流程)流程讓變更依序進入四份文件,而不是只改最後一張 checklist。順序是 proposal(提案文件)、design(設計文件)、spec、tasks。

這是一個完整例題:同一需求變更會同時影響範圍、完成條件、任務與驗收報告。反例則是只在 tasks 加上「寫完全部文章」;這會讓 spec 仍允許 outline,最終出現任務說完成、規格卻沒有要求的矛盾。

任務必須帶著驗證走

「寫 CFA 那一篇」不是好任務。它只說題目,不說完成後讀者能看見什麼。我把任務寫成:完成 CFA 全文,使理論限制、模型語法、fit(模型與資料摘要的相容程度)邊界、完整例題與反例齊全;以正文計數、lavaan(R 的結構方程式套件)語法、識別檢查、媒介說明與來源 locator 驗證。這樣接手的人不用猜「完成」的含義。

這裡的「CFA 全文」指的是本系列固定的三因素設定:

因素 量測題目 lavaan 語法
BE BE01–BE04 BE =~ BE01 + BE02 + BE03 + BE04
EE EE01–EE04 EE =~ EE01 + EE02 + EE03 + EE04
CE CE01–CE04 CE =~ CE01 + CE02 + CE03 + CE04

同樣地,「檢查一致性」也要拆成可跑的項目:30 個檔案、日期連續、目標總字數 88,400、案例識別碼固定、每篇 metadata 完整、依賴鏈無孤島、技術篇六層責任無空白、來源連結可定位。機械檢查抓格式與數量,人工檢查抓推論與語氣,兩者不能互相代替。

這組文件可用 spectra validate(格式檢查指令)檢查格式,再以 spectra analyze(一致性分析指令)檢查能力規格、需求、設計與任務的覆蓋關係。實際操作時也要重算藍圖:例如聲稱總額是 88,400、逐日相加卻只有 88,000,就應回到每日配置找差額,不能只改報告的數字。當前藍圖的 Day 11 配置為 3,000 字,全系列目標合計 88,400;這是配置預算,與完成稿字數分開看。

從文件走到可檢查的任務

本系列原先的 Spectra change 保存五階段、30 篇目標、每日契約、來源紀律與 21 個實作任務。它解決的是跨日承諾與變更記憶,不解決心理計量本身。若規格寫錯,工具只會穩定地執行錯誤規格;所以每個技術主張仍要由後續文章驗算。

延伸閱讀不是再讀更多 Spectra 文件,而是轉向測驗標準與心理計量方法來源。下一篇開始建立概念圖:哪些節點是定義、哪些是證據、哪些是模型,章節順序為何不能只照教科書目錄抄一次?

Spectra 還解決一個容易被忽略的責任問題:進度必須由 artifact 的 checkbox(核取方塊)表示,不能由聊天中的「已完成」代替。每個任務只有在指定驗證真的執行後才勾選;寫完檔案但未跑字數、來源或依賴檢查,仍是進行中。這個規則讓交接者不必相信我的印象,只需讀 tasks 與驗證輸出。

以 BE03 的修改來說,先在需求中記清楚改了什麼,再列出受影響的資料字典、模型與教材;完成各項查核後,才勾選對應任務。這樣接手者可以沿著紀錄重做,而不必從聊天回想先前決定。每日公開前,作者仍需查看實際渲染、連結、公式與語氣。下一篇會把這種依賴關係畫成心理計量概念圖,先看各方法究竟在回答哪個問題。

若要照著做,先挑一個改動建立清單:輸入是哪一份題目文字,受影響的模型使用哪個版本,查核後要留下哪個結果。當依賴欄位把後面的 CFA 篇接到前篇,還要實際讀兩篇內容,確認接走的是同一個案例。連線存在只是一項格式條件,接得合理才是文章編輯要做的判斷。


上一篇
一份教材如何不胡說:把來源、主張與推論分開
下一篇
我要學的是什麼:把心理計量拆成概念地圖
系列文
不是叫 AI 寫教科書:大學教師用 Claude 自學心理計量,打造可驗證、可再教的客製化教材13
圖片
  熱門推薦
圖片
{{ item.channelVendor }} | {{ item.webinarstarted }} |
{{ formatDate(item.duration) }}
直播中

尚未有邦友留言

立即登入留言