大家可以試想一件事情:Agent 製作時,Prompt 調到極限之後呢?當工具的使用慣例無法用 JSON Schema 表達、只能寫在自然語言裡,除了反覆調 Prompt,還有什麼別的辦法?
預期作法是把「工具內化進權重」完整走一遍:先用 MCP 打造一組請假系統工具,部署到 Google Cloud Run;用 Google ADK 接上 Agent 之後,開始觀察哪裡可能會犯錯;用評測把錯誤率量化、把高分維持、低分修正答案,萃取成訓練資料,並且微調成一個小模型、用 vLLM 自架,最後回到評測做模型前後對比。
期待可以讓大家看到 Prompt 和 RAG 之外的另一條路!
I. 前言:當 Prompt 調到極限之後 在生成式 AI 的浪潮中,我們正經歷一場從 Chatbot 到 Agent 的開發模式轉變。如果說 Chatbot...