「AI 幫你看 dashboard」卡住的通常不是模型,是資料:欄位叫什麼沒共識、服務關係只在某人腦袋裡,agent 說「我判斷是這個」也沒人驗證得了。 系列從一組故意寫壞的示範服務開始,分三段疊。先用 OTel Operator 跟 Weaver 把遙測治理做成平台團隊給的介面;再把拓撲、契約、資料品質變成 agent 讀得懂的訊號;最後才是 agent:假設、信心分數,以及「會換掉哪兩個 pod」。
這個欄位有哪些值,registry 答得出來哪一種值代表「這個服務是好的」目前只寫在 dashboard 標題跟幾個人的腦子裡 昨天把 registry 開...
你要驗證的不是它會不會通過是它還會不會擋而一份檢查只會在壞掉的東西上顯現自己的 bug 前面做出了一堆會擋人的東西:三條命名規則、一道 CI gate、li...
設計稿寫的是當初打算做成什麼樣程式碼寫的是後來真的做成什麼樣中間那段沒有人會回頭補 昨天那份上線 checklist 在 shipping-v0 上跑出 7...
一張沒有人驗過的架構圖跟一張畫錯的架構圖在會議室的投影幕上長得一模一樣 昨天那張九宮格,中間「對帳」那一欄三格全是空的,而其中一格的具體長相是這樣: $ u...
一個回傳空集合的檢查可能是在說「沒有問題」也可能是在說「我根本沒讀到」而這兩句話印出來一模一樣 昨天把那張宣告的拓撲跟 Tempo 裡真的看得到的呼叫關係對...
順著圖走的前提是圖上每個節點都判得動而這個前提在真實環境裡不成立 昨天把契約這件事情管好了,等於把注入的 context 降噪,⚠ 從兩個變一個而且帶著證據...
一個裸值加上一個時間戳撐得起「發生了什麼」撐不起「該不該做什麼」 前兩天在補「圖走不走得到」「契約有沒有名字對得上」,這篇往下再挖一層,問一個更底層的問題:...
蓋完一層之後最誠實的動作是把它還不是什麼一格一格數出來 昨天把 CEL(Context Enrichment Layer,情境豐富層)的三個職責跟溯源攤開來...
選一個框架而不是自己寫迴圈換到的往往不是功能是有一天要跟別人解釋的時候講得出來 前面七天都在處理同一件事:讓資料本身帶著足夠的上下文。昨天把 CEL(Con...
我本來想量的是這隻 agent 表現如何先量到的是自己那把尺上面刻著答案 昨天畫了 agent.py 那張四個 node 的圖,但沒有拆它。今天把它跟實際的...