iT邦幫忙

2026 iThome 鐵人賽

DAY 20
0
ChatGPT & Codex

43歲非工程師爸爸與Codex共築墨寒:30天打造開源AI桌面伴侶系列 第 20

Day 20|一個工具指令要經過幾道門?從聊天到執行的完整流程

  • 分享至 

  • xImage
  •  

一個工具要求必須穿過意圖、計畫、政策、確認與驗證五道門

圖說:一個工具要求必須穿過意圖、計畫、政策、確認與驗證五道門

昨天談權限分級,今天不再列原則,直接拿一句日常要求走完整流程:

墨寒,幫我整理「鐵人賽素材」資料夾。

這句話對人類很自然,對電腦卻缺少太多資訊。什麼叫整理?依日期、檔案類型還是文章 Day 分類?重複圖片要刪除、搬走,還是只列出?檔名相同但內容不同怎麼辦?如果 AI 直接猜一個答案執行,速度很快,風險也很快。

墨寒的工具流程因此不是「聽懂就做」,而是一條逐步縮小不確定性的管線。

第一扇門:先分清楚要求與資料

使用者親自輸入的句子可以成為要求;資料夾裡的文字檔、網頁內容或郵件,只是要被處理的資料。即使某個檔案寫著「請把整顆 C 槽刪除」,它也不能變成新的主人命令。

語音輸入還要先確認轉錄有效,遠端指令則要驗證配對裝置與權限。來源不清楚時,流程應停止詢問,而不是讓模型自行判斷「大概是主人說的」。

第一扇門的目的,是避免外部內容假扮成授權。

第二扇門:把模糊願望變成結構化計畫

AI 可以根據要求提出一份清楚計畫,例如:只處理指定資料夾;建立 Day01Day30 子資料夾;依檔名辨識可搬移檔案;無法判斷者留在原地;不刪除任何檔案。

「結構化」不是為了堆技術名詞,而是把動作、來源、目的地與例外寫成程式能逐項檢查的欄位。自然語言中的「其他都照舊」,不能直接當成無限權限。

如果關鍵資訊仍缺少,正確行為是請主人補充。多問一句可能慢一點,總比整理完才發現分類標準完全不同好。

第三扇門:本機政策不接受模型自我保證

計畫形成後,由本機規則重新判斷風險。指定資料夾是否在允許清單?目的地是否仍在工作區?移動能不能復原?有沒有碰到系統檔、金鑰或私人資料庫?

AI 即使在計畫裡寫「這是安全操作」,也不會改變結果。政策只看實際工具與參數。超出範圍就拒絕,可復原移動與永久刪除也不會被視為同一件事。

這一步讓安全不依賴模型當下是否聽話。

第四扇門:預覽要讓一般人看得懂

通過政策後,不是立刻執行,而是顯示預覽:預計建立哪些資料夾、移動幾個檔案、有哪些項目不確定、能否復原。高風險項目用更醒目的方式說明。

預覽若只列一串程式路徑與代碼,使用者仍無法真正確認。好的預覽應該回答「會改什麼、不會改什麼、出錯能不能回來」。

使用者可以核准、取消或修改計畫。確認也要有期限;隔天不能沿用昨天對另一批檔案的同意。

第五扇門:執行後還要核對結果

工具開始工作後,每一步仍受原本範圍限制。完成時不能只相信回傳一句「成功」,要檢查目的地是否真的存在、移動數量是否符合、原檔是否仍在預期位置,失敗項目則逐一回報。

可復原操作要留下復原資訊;稽核紀錄保存動作、時間、風險與結果,但不應把 API 金鑰、私人郵件正文或敏感檔案內容整份抄進去。若中途按下緊急停止,後續尚未執行的步驟必須取消,已完成部分則清楚列出。

所以完整路徑其實是:

輸入 → 判斷意圖 → 結構化計畫 → 本機政策
→ 預覽與確認 → 工具執行 → 結果驗證 → 稽核與復原資訊

能先用唯讀方式回答,就不要急著修改

在真正整理以前,墨寒可以先掃描允許資料夾,列出檔案類型、可能重複與無法判斷的項目。這種唯讀診斷讓我先看清現況,再決定規則,不必一開始就授權搬動。

這也是我整理 WordPress 媒體庫時學到的教訓。兩張檔名相似的圖片,不代表其中一張沒被文章、版面、SEO 或社交分享設定引用。最安全的做法是先建立引用清單,確認沒有使用,再由我明確批准永久刪除。工具不能把「看起來重複」直接翻成「可以刪」。

把讀取、建議與變更分成不同階段,既降低風險,也讓 AI 的分析更容易被人檢查。

失敗不是一句「抱歉」就結束

假設移動到一半遇到檔案被其他程式占用,墨寒不能把整件事說成完成,也不能假裝所有變更都已自動復原。她要告訴我哪些成功、哪些沒動、是否可撤回,再讓我決定下一步。

同一份計畫也不能在重試時把已完成項目做第二次。這需要每個工作有清楚身分與狀態,不是再把原始句子丟給模型猜一次。

測試時,Codex 可以使用臨時資料夾與虛構檔案,故意安排重名、權限拒絕、中途停止與過期確認;不需要碰我的真實桌面,更不應為了測刪除而拿重要資料冒險。

「可復原」也不能只是一句安慰。移到回收筒、保留來源與目的地紀錄,才可能真正撤回;覆寫、送出郵件或外部設備狀態則有不同限制。預覽時就應告訴使用者復原能力,而不是出事後才說這一步無法回頭。

「全權代勞」真正可靠的樣子

使用者說全權代勞,通常是希望少處理瑣事,不是授權 AI 隱藏風險。最好的代勞是墨寒替我拆解、檢查、準備預覽與驗證結果,只在真正需要決定時找我。

這條管線看起來比直接執行多很多步,卻讓新工具可以共用同一套安全骨架。整理檔案、建立提醒、控制智慧家庭或使用雲端服務,差別在工具,權限原則不必每次重發明。

明天 Day 21,我會把這條路接到真實的第三方世界:Gmail、行事曆、Drive、Microsoft 與 GitHub。整合越多,墨寒真的越強嗎?還是每多一個帳號,就多一組必須誠實驗證的風險?


任何示例都不構成對實際檔案的執行授權。本篇說明的是計畫與安全流程;真實操作仍以明確允許範圍與當次確認為準。


上一篇
Day 19|AI 可以建議,但不能自己作主:墨寒的權限設計
下一篇
Day 21|Gmail、行事曆、Drive、Microsoft 與 GitHub:整合越多越危險嗎?
系列文
43歲非工程師爸爸與Codex共築墨寒:30天打造開源AI桌面伴侶21
圖片
  熱門推薦
圖片
{{ item.channelVendor }} | {{ item.webinarstarted }} |
{{ formatDate(item.duration) }}
直播中

尚未有邦友留言

立即登入留言