iT邦幫忙

2026 iThome 鐵人賽

DAY 27
0
Claude AI

用 AI Agent 撰寫長篇技術系列文章系列 第 27 篇

Day 26:審查代理人的設計,扮演最嚴苛的讀者

  • 分享至 

  • xImage
  •  

Day 25:實戰,寫作與視覺雙代理人協同產出圖文草稿 結尾留下一句話,圖文整合的草稿今天已經能穩定產出,但這份草稿目前為止只經過寫作代理人與視覺代理人各自在撰寫或轉譯當下的單點確認,還沒有人用最嚴苛讀者的眼光通盤複核過,這個問題今天還沒有答案,將在下一篇正式揭曉。今天要正面回答這件事。

圖文都到位了,但還沒人挑剔過

Day 25 已經確認,圖文草稿已經能穩定產出,但只經過撰寫或轉譯當下的單點確認,還沒有人用最嚴苛讀者的眼光通盤複核過。今天要開始處理這件事,登場的是四類 Agent 裡最後一個尚未正式展開的角色,審查代理人。

在往下走之前,先把今天的任務範圍畫清楚。今天只定義審查代理人的評判標準從哪裡來,不涉及任何一項具體查核面向的操作方法,這些留給接下來幾天處理。

邊界早就畫過了,但依據什麼判斷還是空白

Day 19:事實查證與撰寫的分工邊界 已經定案,寫作代理人的查證與審查代理人的查核,分野在於撰寫當下的單點查證與成文之後的整體複核,這兩個不同尺度,審查代理人負責後者。同一篇也定案了審查代理人的既定邊界,介入時間點在前面角色都已產出實際成果之後才開始工作,且不負責產出任何一段會直接沿用進成品的新內容,職責是找出問題並回饋,不是動手重寫。

這些既定邊界劃出的是何時介入、能不能動手,但沒有回答依據什麼標準判斷,這正是今天要正式補上的一塊。

最嚴苛的讀者,不是靠感覺挑剔,是拿著答案卷比對

先點名一個容易被誤解的直覺。扮演最嚴苛的讀者,容易讓人以為審查代理人靠的是自己的主觀品味或嚴格程度,像一個憑經驗、憑語感就能挑出毛病的資深編輯。這個直覺雖然貼近人類讀者的想像,但套用在 Agent 身上會失去可驗證性,需要被糾正。

審查代理人查核一篇成品時,依據的不是自己臨時發明或憑空想像出來的標準,而是系列前面已經產出、且已經對外定案過的三份既定依據。

第一份,Day 05:系列的單一事實來源,打造全域錨點檔案 定案的全域錨點檔案,記錄系列中所有已定義專有名詞與已定案架構決策,作為所有 Agent 共享的單一事實來源。審查代理人拿這篇成品裡使用的名詞與描述,去比對是否與全域錨點檔案裡的記錄一致。假設審查代理人讀到成品裡某個 Git 指令的名稱寫法,跟前面天數已經定案的寫法不一致,回頭查全域錨點檔案就能發現這個落差。

第二份,Day 10:定義文章的風格指南與目標受眾畫像 定案的風格指南與目標受眾畫像。審查代理人拿這篇成品的語氣、深度假設,去比對是否符合既定的風格與受眾設定。假設審查代理人讀到某段語氣忽然從口語直白變得生硬制式,回頭查風格指南就能發現這段偏離了既定的語氣設定。

第三份,對應這一篇的 Section Spec 核心目標與段落規格,Day 04:規劃代理人的產出介面,認識 Section Spec 定案的四個必要欄位之一。審查代理人拿這篇成品的實際內容,去比對是否真的完成了規格書當初交代的任務。假設審查代理人讀完某一段,發現這段內容其實沒有回應核心目標交代的重點,回頭查規格書就能確認這是遺漏。

三份既定依據合起來,構成審查代理人「最嚴苛」這個形容詞真正的意思。不是它比其他角色更主觀苛刻,而是它比對的基準比任何單一角色都更完整,它是唯一一個把系列前面所有既定產出物同時攤開來比對的角色。

標準從哪來,跟怎麼查,是兩件事

三份既定依據回答的是審查代理人比對的基準是什麼,今天只確立這件事。

審查代理人具體要查核事實正確性、可讀性、格式一致性這些不同面向時,各自的判斷方法與操作細節,今天不展開,這些留給接下來幾天處理。

今天只確立審查代理人查核時心裡依據的是什麼,不確立它具體怎麼查。

這條分工,Day 03 早就寫好了

這與視覺代理人的情況不同。Day 21:為什麼技術文章需要圖表,視覺代理人的定位 論證視覺代理人的存在理由時,靠的是降低讀者認知負擔這條獨立路徑,因為視覺代理人不在 Day 03 病灶對照表的任何一格裡。

審查代理人則相反,審查代理人的責任,實實在在被寫進病灶對照表裡。

Day 03:拆解寫作工作流,規劃、撰寫、視覺、審查的四種角色 列出的病灶對照表裡,審查代理人是三項病灶的次要協助角色。

內容漂移一項,「審查代理人在成品產出後複核實際內容是否偏離規格」。

事實幻覺一項,「審查代理人在成品完成後再做一輪複核,形成兩道防線」。

零容錯結構一項,「審查代理人發現問題時只需精準指向對應段落與角色,不必要求整篇重寫」。

今天定案的評判標準來源,正是讓這三項次要協助實踐的具體機制。全域錨點檔案與風格指南對應內容漂移的複核依據,審查代理人正是拿這兩份文件去檢查成品是否偏離規格與既定設定。Section Spec 對應零容錯結構複核時如何精準定位到對應段落,審查代理人拿規格書逐段比對,才知道問題出在哪一段,而不必牽動整篇重寫。

事實幻覺的複核,今天只確立標準來源這一層,實際的查核技術本身是下一篇的範疇,今天不展開。

今天我們要做的,就是把 Day 03 早已定案的分工具體展開成評判標準怎麼建立這件事。

答案卷有了,接下來要逐科對答案

今天定案了審查代理人的評判標準,不是靠自己的主觀品味或嚴格程度去挑剔一篇文章,而是拿著系列前面已經產出的三份既定依據去比對,全域錨點檔案記錄的已定案名詞與架構決策,風格指南與目標受眾畫像設定的語氣與深度,對應這一篇的 Section Spec 核心目標與段落規格。

今天也正面回應了 Day 03 病灶對照表裡審查代理人作為內容漂移、事實幻覺、零容錯結構三項病灶次要協助角色的定位,把這個抽象分工具體展開成評判標準怎麼建立這件事,不是重新分配病灶責任。

依據這些標準,審查代理人要逐一查核事實正確性、可讀性、格式一致性這些不同面向,具體怎麼查留給接下來幾天。

評判標準的來源今天確立了,但依據這些標準,具體要怎麼揪出事實幻覺這個病灶最頑固的殘留,技術文章裡語氣篤定卻早已過時或錯誤的技術細節,這件事今天還沒有答案,將在下一篇正式揭曉。


上一篇
Day 25:實戰,寫作與視覺雙代理人協同產出圖文草稿
下一篇
Day 27:事實查核機制,攔截技術文章中的幻覺
系列文
用 AI Agent 撰寫長篇技術系列文章 共 28 篇
圖片
  熱門推薦
圖片
{{ item.channelVendor }} | {{ item.webinarstarted }} |
{{ formatDate(item.duration) }}
直播中

尚未有邦友留言

立即登入留言