Agent 時好時壞,真的只是模型不夠強嗎?
這 30 天,我們將拆解各種 Agent Smell,運用 Tests、Evals、Guardrails 與 Observability 重構 Agent 的工作環境,從 Prompt Engineering 走向 Harness Engineering。
讓執行可重現、結果可驗證、失敗可恢復,成功不再靠運氣。
Day 1 - 你的 AI Agent 不是笨,是工作環境開始發臭了 今天要消除的第一個誤會:Agent 做錯事,不一定是模型不夠聰明。 去年,我寫過一個...
Day 2 - 成功一次就敢上線?Agent Demo 的成功幻覺 今天要消除的臭味:Agent 成功一次,團隊就把它當成可靠。 問題:成功一次,代表它能...
Day 3 - AI Agent Demo 完美、上線失控:一張地圖看懂 Harness Engineering(包住模型的工作系統) 本系列談 AI Ag...