前一天我們談 Agent Protocol。
現在 Agent 已經可以:
這時很多產品會開始追求:
更高 Autonomy。
例如:
不要一直問使用者,讓 Agent 自己做完。
這個方向沒有錯。
但最容易出現的錯誤等號是:
Autonomy 越高 = Agent 越強。
其實更高 Autonomy 同時代表:
所以 Autonomy 不是一個 Personality Setting。
它是一組 Control Budget。
不要只用:
low / medium / high
可以拆成:
這些維度可以分開控制。
Autonomy 最重要的問題之一是:
哪些行動需要人類重新進入 Loop?
例如:
讀檔
自動
跑測試
自動
修改 Source
自動
Deploy Staging
自動
Deploy Production
Approval
寄 External Email
Approval
這不是「Agent 是否自主」。
而是不同 Action 有不同 Approval Boundary。
Production Agent 更適合 Bounded Autonomy。
也就是:
在清楚邊界內高度自主。
例如:
Task:
修正 failing tests
Allowed:
read/write tests
run pytest
modify src/payments
Forbidden:
infra
production
email
Budget:
20 turns
30 tool calls
Approval:
required before deleting files
這種 Agent 可以很自主。
但自由是在 Harness 定義的邊界內。
如果只說:
自己做到完成。
Agent 可能一直:
所以要有:
success condition
failure condition
budget exhaustion
no-progress condition
human escalation condition
沒有 Exit Condition 的 Autonomy 很容易變成 Endless Loop。
模型說:
我有 95% 信心。
不代表它可以因此自動 Deploy。
Confidence 是模型判斷。
Authority 是系統政策。
兩者不能直接綁定。
可以用 Confidence 調整:
但高風險操作仍應由 Policy 決定。
有些系統可以逐步增加自由。
例如:
Level 1
只讀
Level 2
可以修改 Sandbox
Level 3
可以建立 PR
Level 4
可以部署 Staging
Level 5
Production 仍需 Approval
這比一開始給所有權限更安全。
Autonomy 可以根據:
逐步調整。
如果 Agent 最近表現變差,也可以降低 Autonomy。
例如:
不要只會增加自由,不會收回。
高 Autonomy 不代表永遠不要問人。
真正成熟的系統應該知道:
哪些決策不值得模型硬猜。
例如:
Handoff 是 Autonomy Design 的一部分,不是失敗。
每個 Task 可以有:
turn_budget
tool_budget
token_budget
cost_budget
time_budget
subagent_budget
Autonomy 的實際範圍,就是這些 Budget 的交集。
如果 Agent 可以自由開 100 個 Subagent,那不叫高 Autonomy。
那叫沒有成本控制。
要測的不只是 Success Rate。
還可以測:
好的 Autonomy 不是人類介入越少越好。
而是:
人類只在真正需要時介入。
沒有 Budget 與 Policy。
混淆判斷與 Authority。
風險完全不同。
可靠度下降仍保持高權限。
Agent 只好硬猜。
自主執行變成無限 Loop。
可以用一張表:
| Action | Auto | Approval | Forbidden |
|---|---|---|---|
| Read workspace | ✓ | ||
| Run tests | ✓ | ||
| Modify scoped files | ✓ | ||
| Delete files | ✓ | ||
| Deploy production | ✓ | ||
| Read secrets | ✓ |
再加:
這就是一個可操作的 Autonomy Model。
Autonomy 不是讓 Agent「自己決定更多」。
而是:
在可觀察、可撤銷、可限制的邊界內,減少不必要的人類介入。
最重要的原則:
自主性應該由 Budget、Permission、Approval 與 Verification 定義,不是由 Prompt 宣布。
下一篇會進入 MCP、Plugins 與 Channels:
Agent 能連更多外部系統後,真正需要設計的是 Capability Discovery、Trust Boundary 與 Connection Lifecycle。
完整系列與程式碼範例收錄於 https://github.com/hardness1020/awesome-agent-architecture