iT邦幫忙

鐵人檔案

2026 iThome 鐵人賽
回列表
AI Security

Agent的系統防禦升級 系列

Agent 在呼叫外部工具時,容易受到竄改內容影響,導致間接提示注入,達成不越權的攻擊,目標是要在 Gatekeeper的攔截更完善。

參賽天數 22 天 | 共 22 篇文章 | 2 人訂閱 訂閱系列文 RSS系列文 團隊四點還吃牛肉man
DAY 11

DAY 11 // AgentDojo 的主要模組介紹

AgentDojo 專為評估與測試 Agent 安全性所設計的動態開源框架。本文深入解析 AgentDojo 主要模組,並分享如何直接透過 Python 程式碼...

2026-09-04 ‧ 由 infi1156 分享
DAY 12

DAY 12 // agentdojo.benchmark安全評測的主要模組

上篇文章提到的查詢模組,從 dir(agentdojo.benchmark) 的輸出可以看到,這個模組匯集了任務執行函式、結果資料結構、序列化工具,以及多種例外...

2026-09-05 ‧ 由 infi1156 分享
DAY 13

DAY 13 // AgentDojo 的 Workspace 模擬以及重新開始

原本都是在 code 完成,後來發現透過 Terminal 就能查詢 AgentDojo Benchmark 指令所提供的參數: python -m agent...

2026-09-06 ‧ 由 infi1156 分享
DAY 14

DAY 14 // 改用 Ollama 本地模型完成 Workspace 模擬

操作後發現 OpenAI API 需要付費 credits,直接改用 Ollama 的免費模型,讓它直接在本機執行。下載 Ollama 後在 Terminal...

2026-09-07 ‧ 由 infi1156 分享
DAY 15

DAY 15 // AgentDojo User Task 任務內容在Terminal如何運作?

完成 AgentDojo 的環境建置後已經可以使用 Ollama 在本機執行 Qwen3 4B,並讓 AgentDojo 透過 Local LLM 與模型建立連...

2026-09-08 ‧ 由 infi1156 分享
DAY 16

DAY 16 // AgentDojo 本地模型測試與 Function Calling 問題分析

目前架構: ┌─────────────────────┐ │ AgentDojo │ │ Benchmark Task │ └─...

2026-09-09 ‧ 由 infi1156 分享
DAY 17

DAY 17 // AgentDojo × Ollama Qwen3:4B 的 Function Calling 測試

今日主要目標是進一步確認 AgentDojo 使用 Qwen3:4B 時,為什麼 User Task 的執行結果一直維持 0%。 之前測試已經確認,Ollama...

2026-09-10 ‧ 由 infi1156 分享
DAY 18

DAY 18 // 從 Qwen3:8B 工具呼叫到工具選擇問題定位

切換至 Qwen3:8B,4B 模型容易出現 Function Calling 格式錯誤或無法正確選擇工具的情況。今天正式將模型提升到 8B,希望能更穩定地完成...

2026-09-11 ‧ 由 infi1156 分享
DAY 19

DAY 19 // AgentDojo 多工具環境下的工具選擇實驗

目前使用 Windows、VS Code PowerShell 以及 Python .venv 環境執行 AgentDojo。Ollama 運作於本機 1143...

2026-09-12 ‧ 由 infi1156 分享
DAY 20

DAY 20 // Qwen3:8B 的 Function Calling 失敗原因與工具選擇問題

重新確認 AgentDojo 與 Ollama 基本環境 首先針對先前發生的 Connection error 進行確認。執行 user_task_1 時,出現...

2026-09-13 ‧ 由 infi1156 分享