iT邦幫忙

2026 iThome 鐵人賽

DAY 24
0

文章說「alpha(內部一致性信度係數,不證明單一構念)高,所以題目只測一個構念」,後面還附上真的 DOI(文獻永久識別碼)。這樣就有來源了嗎?Day 23 的 F06 正是在檢查這個差別:文獻存在,未必支持那句話。今天從「alpha 不證明單維」這句較窄的主張跟做一次,記下作者、版本、原文位置與支持範圍,再把方法用回整本教材。例如 Day 13 的四題例:題目變異數總和 4、總分變異數 8.8,alpha = 4/3 × (1 − 4/8.8) ≈ .727,這個數字仍不證明單一構念。

一列不是一篇文獻,而是一個主張

欄位 範例
day / claim 13/alpha 不證明單維
status 第一手來源已支持+worked counterexample
source P04:Sijtsma(2009),DOI 10.1007/s11336-008-9101-0
locator §4.2「Alpha and Internal Test Structure」,pp. 115–117;Table 5 在 p. 117
Claude role 建議檢索詞、拆主張
check 2026-09-08:Codex 開啟出版者全文,核對 §4.2 與 pp. 116–117;作者複核待做
limitation 本篇未涵蓋所有 reliability coefficients

這張表的用途是讓正文句子可追溯;它不能以欄位完整掩蓋來源品質或適用性。locator 精確,來源仍可能只部分支持。

六層責任

資料機制是文章、標準、官方文件與計算留下可引用資訊;目標是核對核心主張與證據的支持關係;假設是版本及來源位置對應,轉述未越過原文條件;可觀察量是原文、DOI、頁章與重現輸出;決策規則是分辨來源支持、教學簡化、計算重現、模擬觀察、作者經驗與待研究問題;記錄能讓他人回查,卻不能自動評定全部文獻品質。

完整例題:把頁碼和句子接起來

本輪開啟 Sijtsma(2009)的出版者全文,讀到 §4.2 在 p. 115 說明 alpha 與內部結構不能一一對應;pp. 116–117 的多維例子與 Table 5 給出不同因素結構卻有相同 alpha 的設定。這支持表中的窄主張,不能順便推成「omega(以因素負荷估計的信度係數)永遠較好」。讀者可沿 DOI 到原文,以節名與印刷頁碼定位;PDF 檢視器的第幾頁不是期刊頁碼。

這次重查只補這一項主張,其他列沿用原查核日期。

代號對照見文末:

day claim status source-class source locator verified-on Claude role human-check limitation
13 alpha 的解釋依賴題目與誤差模型條件 第一手來源已支持 原始/方法論文 P03、P04、P05 coefficient assumptions 2026-08-25 比較草稿 手算與文獻三角查核 omega 也不是無條件優越
14 驗證的是指定分數解釋與用途的主張 第一手來源已支持 標準/方法論文 P01、P06、P07 validity arguments 2026-08-25 推論鏈草稿 比對三來源 文章採 argument-based 教學主線

效度主張要分清來源角色

Day 14 的核心句是「評估的是指定分數解釋與用途,而非量表永久屬性」。我使用三個來源:Standards(美國教育與心理測驗標準)2014 作專業規範,Messick 1995 提供 construct-validity 論述。Kane 2013 展開 interpretation(分數解釋)/use argument(論證)。三者角色不同,不能寫成彼此完全同義。

ledger(來源與主張帳本)分別記 locator 與用途:Standards 控制測驗實務責任;Messick 支援分數意義(score meaning)、evidence(證據)與 consequences 的連結;Kane 支援把推論與 assumptions 寫成 argument。文章採 argument map 是作者的教學選擇,因此另標 pedagogical simplification,不冒充三位作者共同提出的模板。

Claude 協作:把「找文獻」拆成兩步

第一步讓 Claude 只產生檢索詞、作者候選與可能段落,不允許輸出正文 citation。第二步由我開 DOI、官方 PDF 或 package manual,確認 bibliographic facts 與 locator。第三步才讓 Claude 比較已提供的摘錄,指出支持範圍與衝突;最後由作者寫 claim。

若候選答案把 lavaan(R 的結構方程式套件)教學頁當成測量恆等性理論的主要依據,要拆開兩種問題:查 group.equal 與語法可用官方教學頁;討論理論與適用條件,則需回 Meredith、Chen 等方法來源。來源類別影響它能支持的句子,不能只以「官方」二字處理所有主張。

反例:locator 對,版本錯

CRAN mirt(R 的試題反應理論套件)目前公開版本可能高於本機實際執行版本。若 ledger 只寫「CRAN current」,讀者不能重現 Day 22 的結果。帳本因此同時記官方查核版本與 execution version;兩者不同不是錯,假裝相同才是錯。

另一個 failure case(失敗案例)是以搜尋結果摘要代替原文。摘要可協助定位,卻常省略條件;核心主張不能只引用搜尋 snippet。若全文不可得,帳本標示可見範圍,主張縮小或另找可核對來源。

三層閱讀定位

每篇結尾提供基礎、發展、前沿三層,不固定三篇。基礎來源讓讀者重建本文定義;發展來源處理主要方法決策;前沿來源指出本文刻意不展開的爭論。某來源可在一篇屬基礎、另一篇屬發展,層級由閱讀任務決定。

連結健康和證據健康分開

HTTP 連結能開啟,只證明網頁可到達;它可能已更新、redirect 到不同版本,甚至只剩書目頁。驗證報告因此把 link reachable、bibliographic match、locator checked、claim supported 分成四欄。自動工具檢查第一欄,後三欄由人工完成。

ledger 也記 negative search:某主張查過哪些關鍵字仍未找到第一手支持。這避免下一輪 Claude 因相同問題再次給出同一批不適用來源。not-found 不代表主張為假,只表示目前不能以學術事實口吻放進文章。

最後,我抽查的是「高風險句」而非隨機句數:門檻、因果、群體比較、個人決策、軟體預設與全稱判斷優先。教材中最需要來源的,通常不是名詞定義,而是讀者可能據以採取行動的那一步。

原問題的答案是:來源帳本追蹤完整 claim 與 support relation,不只收集文獻。基礎閱讀是 Standards 與官方文件;發展閱讀是方法原文;前沿閱讀依節錄表的 limitation 欄前進。

今日產物是 30 列每日核心主張、21 個核心來源 ID(來源代號)與查核日期。下一篇把來源、公式、程式、連結、題解、版本與勘誤放進同一個 release gate(發布版本),決定文章何時能從 draft 進 verified(已通過本系列查核)。

來源與協作揭露


上一篇
用反例教書:建立心理計量 failure atlas
系列文
不是叫 AI 寫教科書:大學教師用 Claude 自學心理計量,打造可驗證、可再教的客製化教材 共 24 篇
圖片
  熱門推薦
圖片
{{ item.channelVendor }} | {{ item.webinarstarted }} |
{{ formatDate(item.duration) }}
直播中

尚未有邦友留言

立即登入留言