Day 27 的 Capability Ledger 一共有十四列:六列 KEEP、兩列 ADOPT、四列 DEFER,還有兩列 UNKNOWN。只看狀態,最刺...
前一篇重新回放了 Day 1 那筆被不可信 Log 誘導的 Tool Call。結果一半很清楚:哪個 Tool 被呼叫、policy 如何判斷、canary 最...
文件沒寫的,記錄裡都有 Day4 提過一件事:Pi 的官方文件沒有用文字說明它的 agent loop 怎麼運作。但它有一個更直接的東西——每一次對話都會留下完...
Day 25 的 SRE Agent 已經能從 Loki result 拿到 trace_id。拿到這串 ID 之後,最直覺的做法是貼進 Tempo,沿著 sp...
Day 1 的 SRE Agent 有一個 query_logs Tool。名字看起來很像回事,實際上只會把 Repo 裡準備好的 JSONL fixture...
agentgateway 1.5.0 的 LLM Analytics 跑起來後,不用先畫 Grafana,就能看到 calls、token usage 與估算成...
做完 Agent telemetry 之後,Dashboard 很快就會出現一個合理需求:既然每一筆請求都有登入者,能不能直接按 team member 看流量...
Day 21 把 Gateway、Agent Runtime 與 MCP adapter 的 Trace 接起來後,同一筆 action 已經可以跨服務查回來。...
Day 20 的 Tempo waterfall 有兩個 span:invoke_agent 底下接著 execute_tool。欄位契約看起來完整,actio...
Day 19 把 Agent Registry 的邊界停在一個很現實的位置:平台可以知道某個 Agent 已經進入 Runtime,卻還不知道它被誰叫起來、代表...
Day 18 的 BYO Agent 已經能被 kagent 部署、找到,也能讓另一個 Agent 透過 A2A 呼叫。當團隊開始累積更多 Agent,下一個麻...
Day 17 把 A2A 的 Agent Card、routing 與 invocation 接通之後,下一步就是把自建 Agent 放回 kagent,看看其...
Day 16 已經證明 kagent 能部署 declarative Agent,LLM 與 MCP traffic 也能經過 agentgateway。接著把...
Day 15 把既有 Ingress 與 agentgateway 的流量責任切開之後,還有一大塊工作沒有人接:Agent 要用哪個 Runtime、如何部署、...
把 agentgateway 接進 Kubernetes 之後,我們沒有拆掉原本的 Ingress。public host、certificate 與其他服務都...
評估 LiteLLM 時,我們最後沒有採用,其中一個顧慮就是 virtual key 帶來的身分管理。幾個月後接 kagent 的 LLM path,我卻又在...
我一開始找 AI Gateway 的條件很直接:把不同 LLM provider 收進同一個 OpenAI-compatible endpoint,再補上 ro...
同一個 Observability MCP 有兩種呼叫者。值班工程師從 CLI 登入後查詢資料,Scheduler 則在沒有人操作時定時執行。兩邊拿到的 acc...
Day 10 把值班工程師的入口 Token 原樣送到第二個 MCP Server,結果不是撞上 audience 驗證,就是讓 Audit 誤以為整條鏈都由同...
Day 9 把一次 Agent 任務裡的 Human、Agent 與 Workload 都放回 Delegation Context。欄位補齊之後,下一個麻煩很...
Day 8 的 Gateway 已經能驗證 issuer、audience、scope 與 policy claim,但那只能證明「這枚 Token 能不能送到...
把 Cognito 接進 Gateway 的那一輪,我原本以為最麻煩的部分已經處理完了。Human SSO 可以登入,Gateway 也能驗 JWT signa...
Day 6 把登入路徑收斂成兩條:互動式使用者走 Authorization Code + PKCE,無人服務走 Client Credentials。Toke...
Day 5 盤點完 Identity 缺口後,下一步看起來很直覺:替 Gateway 接上一個可信的 OIDC issuer,讓 synthetic-user-...
Day 3 的 Tool allowlist 已經把 delete_demo_database 擋在 Function Tool 前。相同的外部惡意 Log、相...
前一天的 Lab 裡,SRE Agent 讀到一段藏在外部 Log 裡的惡意指令。Gemini 提出了 delete_demo_database,Keyword...
這個系列的 Lab 裡有一個 SRE Investigation Agent。它會讀取合成的系統 Log,使用 query_logs 和 query_metri...
Day 1 的 SRE Investigation Agent 做了一件不該做的事。它讀到一段被動過手腳的 Log 後,沒有停在分析,而是向 Google AD...
2025 年的鐵人賽,我寫的是 LLM 可觀測性。那時追的是 Prompt、Response、Token、Latency、Cost,還有 Evaluation...
完整內容,請至幹話王 Grafana o11y-bench 深入剖析:讓 AI 真正面對 on-call 現場 LLM 到底能不能當 SRE?不是問它「知不知道...