如果今天改了 BE03 的題意,後面的 CFA(驗證性因素分析,把理論寫成可被資料反駁的模型)、IRT(試題反應理論)和學生學習單要不要一起改?BE03 是本系列合成示範量表 ENGAGE-v1 的一道行為投入題,第 8 天會完整介紹題本與資料;這裡先把它當成一個會被後續章節反覆使用的識別碼。一張發文日期表找不出這些影響。前四篇已訂出完成條件、先備診斷與來源紀律,今天把它們放進 Spectra(規格驅動的開發工具),保存每次修改的理由,以及哪些文章需要跟著檢查。
我在這個系列選用 Spectra 保存寫作承諾:每篇要回答什麼、什麼狀態才算完成、改動會影響誰。這是工作流程的選擇,沒有據此宣稱工具已改善教學成效。本篇把文件與操作說清楚,後續只有需求變更、驗收或內容偏離規格時再回來使用。
proposal:為何值得寫、範圍是什麼
↓
design:30 篇如何累積、有哪些取捨
↓
spec:什麼狀態才算符合要求
↓
tasks:依賴順序、交付行為與驗證方式
這張圖的用途是區分文件責任。它不能保證文章內容正確;Spectra 只會指出我的 artifact(產出文件)是否自洽,不能判定 alpha(內部一致性信度係數)的解釋是否符合心理計量理論。學科查核仍回到來源、公式、資料與反例。
最直覺的替代方案是一張 30 列試算表。它很適合排日期與題名,但不容易表達規範句、失敗情境和任務驗證。另一個替代方案是讓 Claude 每天讀前文後自行續寫;這把一致性寄託在模型當下是否抓到正確脈絡,也沒有留下需求變更的理由。
把前四天的成果交給 Claude 時,可以要求它找出能用 MUST(規範用語)/SHALL 表達、並能以 WHEN(驗收情境用語)/THEN 驗收的規則,先不增加心理計量主張。如果候選句只寫「每篇應該有來源」「文章應該前後連貫」,就繼續問:要查看哪一列、哪份資料,才能判定它沒有做到?
我改寫成兩個可觀察例子:
depends-on(承接前篇的欄位)與 hands-off-to(交給下一篇的欄位)都不能缺,而且依賴圖連通。這次 AI 的價值是快速窮舉規則候選;教師的工作是把形容詞改成可失敗的條件。沒有失敗條件的規格,在截止日前通常會被解釋成「差不多就好」。
本系列原本規劃前十篇完整稿、後二十篇 executable outline(大綱)。當我決定直接寫完 30 篇時,這不是多做一點而已,而是交付狀態改變。spec(規格文件)必須從「後二十篇有 outline」改為「全部文章有完整正文且 verified(已通過本系列查核)」。tasks(任務清單)也要拆出後二十篇寫作與驗證。Spectra 的 ingest(需求變更納入流程)流程讓變更依序進入四份文件,而不是只改最後一張 checklist。順序是 proposal(提案文件)、design(設計文件)、spec、tasks。
這是一個完整例題:同一需求變更會同時影響範圍、完成條件、任務與驗收報告。反例則是只在 tasks 加上「寫完全部文章」;這會讓 spec 仍允許 outline,最終出現任務說完成、規格卻沒有要求的矛盾。
「寫 CFA 那一篇」不是好任務。它只說題目,不說完成後讀者能看見什麼。我把任務寫成:完成 CFA 全文,使理論限制、模型語法、fit(模型與資料摘要的相容程度)邊界、完整例題與反例齊全;以正文計數、lavaan(R 的結構方程式套件)語法、識別檢查、媒介說明與來源 locator 驗證。這樣接手的人不用猜「完成」的含義。
這裡的「CFA 全文」指的是本系列固定的三因素設定:
| 因素 | 量測題目 | lavaan 語法 |
|---|---|---|
| BE | BE01–BE04 | BE =~ BE01 + BE02 + BE03 + BE04 |
| EE | EE01–EE04 | EE =~ EE01 + EE02 + EE03 + EE04 |
| CE | CE01–CE04 | CE =~ CE01 + CE02 + CE03 + CE04 |
同樣地,「檢查一致性」也要拆成可跑的項目:30 個檔案、日期連續、目標總字數 88,400、案例識別碼固定、每篇 metadata 完整、依賴鏈無孤島、技術篇六層責任無空白、來源連結可定位。機械檢查抓格式與數量,人工檢查抓推論與語氣,兩者不能互相代替。
這組文件可用 spectra validate(格式檢查指令)檢查格式,再以 spectra analyze(一致性分析指令)檢查能力規格、需求、設計與任務的覆蓋關係。實際操作時也要重算藍圖:例如聲稱總額是 88,400、逐日相加卻只有 88,000,就應回到每日配置找差額,不能只改報告的數字。當前藍圖的 Day 11 配置為 3,000 字,全系列目標合計 88,400;這是配置預算,與完成稿字數分開看。
本系列原先的 Spectra change 保存五階段、30 篇目標、每日契約、來源紀律與 21 個實作任務。它解決的是跨日承諾與變更記憶,不解決心理計量本身。若規格寫錯,工具只會穩定地執行錯誤規格;所以每個技術主張仍要由後續文章驗算。
延伸閱讀不是再讀更多 Spectra 文件,而是轉向測驗標準與心理計量方法來源。下一篇開始建立概念圖:哪些節點是定義、哪些是證據、哪些是模型,章節順序為何不能只照教科書目錄抄一次?
Spectra 還解決一個容易被忽略的責任問題:進度必須由 artifact 的 checkbox(核取方塊)表示,不能由聊天中的「已完成」代替。每個任務只有在指定驗證真的執行後才勾選;寫完檔案但未跑字數、來源或依賴檢查,仍是進行中。這個規則讓交接者不必相信我的印象,只需讀 tasks 與驗證輸出。
以 BE03 的修改來說,先在需求中記清楚改了什麼,再列出受影響的資料字典、模型與教材;完成各項查核後,才勾選對應任務。這樣接手者可以沿著紀錄重做,而不必從聊天回想先前決定。每日公開前,作者仍需查看實際渲染、連結、公式與語氣。下一篇會把這種依賴關係畫成心理計量概念圖,先看各方法究竟在回答哪個問題。
若要照著做,先挑一個改動建立清單:輸入是哪一份題目文字,受影響的模型使用哪個版本,查核後要留下哪個結果。當依賴欄位把後面的 CFA 篇接到前篇,還要實際讀兩篇內容,確認接走的是同一個案例。連線存在只是一項格式條件,接得合理才是文章編輯要做的判斷。