我主要負責寫作與判斷,AI 負責搜尋、整理、轉換與檢查。這 30 天,我會拆解一條正在日常運作的 AI 內容產線:情報與會議如何進場,如何變成可編輯草稿與深度專欄,視覺素材如何分流,內容如何經過人工審核後發布,再把結果帶回下一輪。
系列會依序走過整體架構、真實案例、品質檢查、失敗處理、量測與整合。核心是把內容工作工程化,同時保留人的觀點與責任。
我把一份合成測試資料裡兩個人的名字整組對調,再算一次說話者分群的錯誤率。結果是 0。 不是 0.1,不是接近 0,是 0。名字全錯,指標說沒問題。 這不是指標壞...
第 11 天結尾,具名引言和待辦負責人停在 needs-human。 停是停了。但我回頭看那個標籤,它其實什麼都沒交代:誰來看?看完把答案寫在哪?下次程序啟動時...
一筆 JSON,欄位齊全、型別正確、引用的來源片段真的存在、文字摘要也對得上。 它把「可以先評估是否整理檢查表」這句話標成了承諾。 前兩層檢查全部放行。抓到它的...
AI 從會議逐字稿抓出一件待辦,人按了批准,程式去建立。呼叫送出去,畫面一直轉,沒回應。 這時候只有兩個選擇,兩個都不對。不重送,那筆待辦可能根本沒建。重送,可...
一份會議逐字稿進來,最後要變成一份可以交給人審的會議報告。中間要過五關:每句話回得到原始字幕、分得出誰跟誰在說話、決定要不要把匿名標記換成真名、挑出重點、把「有...
2026-09-08 晚上 22:49,我坐在電腦前查自己的兩條排程,只想知道一件很簡單的事:你們今天到底有沒有做事? 一條是每日情報,抓當天的新訊息寫成一份...
昨天我把「這一輪要處理哪些新資料」講完了。一輪有自己的識別碼,每次進入有自己的編號,選了什麼、刷掉什麼都留了原因。 然後就會遇到今天這一題:那一輪做到一半停了,...
我做了兩份紀錄,丟給同一個驗收器。 第一份,成品合格,流程被判失敗。第二份,成品不合格,流程卻被判通過。 兩份都是固定的合成資料,不是我真的跑出來的事故。但這個...