昨天那道 DOI 閘門有個明顯的盲區:引用真實存在的文獻,但把它的結論講反。DOI 驗證全綠,內容全錯。
今天講我們怎麼撞見這個盲區的。
2026 年 7 月,我在準備一份給研究所演講用的講義,裡面引了一位所長的論文、還有一段統計示範,數字來自實際跑過的程式。
第一次審查,我把講義全文丟給一組純文字的審查流程——多個 AI 各自讀稿、挑毛病、交叉彙整。結論:可以上台。
不放心,又加了第二次:這回派的是能實際開檔案的隊友,要求他去讀被引論文的原始 PDF、重跑講義裡的統計程式。
第二次抓出兩個致命錯誤。
一,所長論文的結論被講反了。 講義引述的方向跟原文相反。純文字審查抓不到,因為審查者手上只有講義——講義自己前後一致,讀起來毫無破綻。只有把原始 PDF 打開對照,才看得出「講義說的」跟「論文說的」是兩回事。
二,講義上的數字跟程式輸出對不上。 大概是某次改稿時數字沒跟著更新。同樣,純文字審查看不出來,因為那個數字本身很合理;只有真的把程式重跑一遍,才知道它已經不是現在的輸出了。
一句話總結這次教訓:純文字審查驗的是內部一致性,但最貴的錯誤是外部不一致,稿子跟世界對不上。
第一次審查不是隨便做的,好幾個引擎、好幾輪交叉。但審查者再多,只要大家手上都只有稿子本身,就全部共享同一個盲區。
這跟 Day 4 講的「並進互相抓錯」不衝突,而是它的邊界條件:並進抓得到的,是「答案之間不一致」的錯;抓不到的,是「所有答案一致地錯」的那種,而引用曲解恰好是後者,因為錯誤的源頭只有一份稿子,大家都從它出發。
要打破盲區,加人沒用,要加的是工具:至少一位審查者必須能碰到外部真相,打開原始文獻、重跑程式、查原始資料。
現在我們的複檢規格裡有一條硬要求:長稿、講義、簡報的複檢,一定要配至少一位「能讀原始檔案、能執行程式」的隊友,純文字審查不管幾輪都不算數。
具體的工單寫法也變了。以前寫「幫我審這份講義」,現在寫「去讀某某論文的 PDF 原文,比對講義第 N 段的引述方向;重跑某某程式,核對講義裡的所有數字」。把「碰外部真相」寫成明確步驟,而不是期待審查者自己想到。
第四幕到這裡剛好三層:
一條引用要過的三道閘
存在層 (Day 19-20) 內容層 (Day 21) 問法層 (Day 22)
這篇文獻真的存在? ──→ 你說的是它說的嗎? ──→ 問句逼得出證據嗎?
〔程式全自動〕 〔要能開原文的隊友〕 〔工單怎麼寫〕
Day 19 是「存在層」,這篇文獻到底存不存在、是不是這篇。Day 20 用程式把存在層自動化。今天是「內容層」,文獻存在,但你說的是它說的嗎?這層自動化不了,只能靠拿著原文的人(或拿著原文的 AI)逐段對。
還有第三層:問的方式本身會污染答案。明天講那個,同一位審查者,同一份稿子,問法不同,結論相反。