「AI 幫你看 dashboard」卡住的通常不是模型,是資料:欄位叫什麼沒共識、服務關係只在某人腦袋裡,agent 說「我判斷是這個」也沒人驗證得了。 系列從一組故意寫壞的示範服務開始,分三段疊。先用 OTel Operator 跟 Weaver 把遙測治理做成平台團隊給的介面;再把拓撲、契約、資料品質變成 agent 讀得懂的訊號;最後才是 agent:假設、信心分數,以及「會換掉哪兩個 pod」。
一份漂亮的結論跟一場漂亮的調查在報告上長得一模一樣 昨天那場 RCA 跑得很好看,四次工具呼叫、假設樹有列、工具報錯自己救回來,最後結論指名 v2.5.0...
一個回空表格的查詢跟一個看不到三成輸入的守門在紀錄上都是一切正常 昨天新加的那個 fixture 兩次都失敗,兩次都是同一個動作:一句查詢回空的,然後它換一...
一句「建議回滾」跟一句「回滾會換掉 demo 這兩個 pod,回到 revision 24」差的不是禮貌,是對方能不能決定 前面幾天都在處理「agent 講...
前面二十三天我一直在驗證那條沒有人在看的路徑而真正會被用的那一條缺假設樹、缺信心分數、缺一顆按鈕還缺一張帳單而我自己去用的時候拿到一個答得很漂亮的錯答案 昨...
每一段單獨跑都是綠的這句話跟「整條鏈是通的」中間隔著一次真的把它們接起來 前面二十四天,每一天都在自己那一段裡驗證自己那一段。今天要把它們接起來跑一次:一個...
一個沒有人按過的開關跟一個不存在的開關平常看起來完全一樣只有在事故當下才分得出來 昨天用第一天那組題目重算了一次總分,把前面那條「治理 → 資料 → 判斷」...
「建議回滾 payment-service」是一句話一句話沒有狀態、不會過期也沒有辦法在事後回答那天到底是誰按的 昨天把四個平面跟那條從建議到自主的光譜攤開...
信心分數是推理平面自己講的治理平面沒有義務相信它這句話聽起來很酸但它是第一道門的全部內容 昨天那輪演習跑完,agent 對同一個事故給的信心是 0.65。前...
「這個我們上次遇過」是一個資深值班的人最值錢的一句話而這套系統一開始連「上次」是什麼時候都認不出來 前面把五道門攤開之後,有一個東西一直在旁邊沒被處理:這隻...