前面幾天分析了現象跟根因,今天回到一個具體的真實案例,完整走一次「AI 下了一個看起來合理的結論 → 使用者一句話推翻 → 後續證明原本的結論是錯的」這個過程。
在一次長時間、大範圍授權的重構工作階段裡,AI 處理到某個項目時,嘗試連線失敗,判斷「這個項目看起來已經沒有實際使用、可以視為停用」,因此跳過,沒有繼續處理。使用者的回應很直接:「一樣用 ssh 接著做啊!又不是連不上」——這句話裡藏著兩層資訊:第一,連線的管道本身沒有真的斷(還有其他路可以試);第二,「沒有連上」跟「已經沒人用」中間,AI 直接跳過了本該做的驗證。
這句糾正表面上只是要求「重試」,但實際上糾正的是判斷標準本身:「一次沒成功」不等於「證明走不通」,中間需要更多次嘗試、更多角度的驗證,才夠格下結論。這不只是「請再試一次」這麼單純,是在明確告訴 AI:你採用的判斷標準,門檻設得太低了。
在接續使用其他連線方式重新嘗試之後,證實了這個項目其實仍在正常使用中,並非如先前判斷般已經停用——如果當時真的採信了第一次連線失敗就下的結論,這個項目就會被錯誤地跳過整個處理流程,留下一個沒被真正檢視過的缺口。這個結果反過來驗證了「多試幾次」這句糾正是對的,也讓後續類似情境的判斷標準被重新校準。
回想你有沒有因為一句簡短的糾正,才發現自己(或協作對象)先前下的某個結論其實站不住腳?那句糾正糾正的,是表面的動作,還是背後的判斷標準?
明天開始定規則:把重試次數、驗證責任寫成一句話的前提條件。