「人工複查已經很仔細了,為什麼還要另外寫一支掃描工具?」
因為「已經很仔細」跟「不會漏」是兩件事。這個系列的寫作規範裡明白寫著一句話:已經整理過的素材筆記,都曾經漏掉一個真實識別字串沒改掉。這不是說人不用心,而是說明人工複查有結構性的極限——注意力會疲乏、會習慣性地看過某些格式而不起疑心。這篇要講的是,一次漏抓的教訓怎麼變成一條可以重複執行的規則。
去識別化的規則清單不是一開始就想好所有情況才寫出來的,而是每次抓到一個新的識別資訊漏網之魚(不管是自己發現還是被抓到),就把對應的樣式加進規則清單,讓下一次掃描能自動抓到。這個過程分成幾個階段:
第一階段:發現漏洞——人工複查或使用者指出,某個具體措辭其實足以讓讀者反推出原始情境,即使那個措辭單獨看很技術性、不涉及廠商名稱。
第二階段:歸納樣式——不是只改掉那一個具體字眼,而是問「這一類措辭的共同特徵是什麼」,把特徵寫成一條可以比對的樣式規則。
第三階段:寫進清單,讓下一次自動觸發——把這條樣式加進掃描工具的規則清單,之後任何草稿只要出現符合這個樣式的內容,都會被自動攔下來,不需要每次都靠人重新想起這條規則。
不是所有去識別化判斷都適合寫成自動化規則。明確、機械式、可以用字串比對或正規表示式判斷的規則(真實目錄名、廠商代碼樣式、特定業務術語)適合自動化——這類規則不需要理解上下文,純粹是「出現這個字串就攔下來」。但需要理解語意脈絡才能判斷的情況(例如某個案例的敘事角度會不會暗示產業類型)沒辦法完全交給自動化,還是需要人工判斷,自動化工具最多只能在這類情況下標出「WARNING,建議人工複查」,而不是直接判定違規。
如果你的工作流程裡也有一類反覆需要人工複查的規則,有沒有想過把它拆成「機械式部分交給工具自動檢查」跟「語意判斷部分保留給人工」兩層?
Day 10 會轉向另一道品質守門機制:事實查核——為什麼技術主張不能只憑內部踩坑經驗的記憶,就直接寫進文章裡。
第一次意識到「人工複查會漏」這件事有多真實,是看到規範裡直接寫出「已經整理過的素材筆記都漏過一次」這句話——這不是一個假設性的警告,而是真實發生過的教訓,直接被寫進規則裡,變成後面所有草稿都要遵守的紀律。