當 AI Agent 從 POC 推上生產線,「能 demo」與「能上線」之間的鴻溝遠比想像深。這 30 天用紅隊攻擊、藍隊防禦的實戰對抗,把 Agentic AI 這個新戰場攤開來看——間接注入、Tool Abuse、跨 Agent 連鎖攻擊,搭配 GCP 原生工具鏈與 Google 開放權重護欄模型 ShieldGemma 逐一補防線,並完整展開 iThome AADay 2026 演講的五大架構陷阱。延續 8 月系列的 GCP Security 骨幹,以 Google SAIF 框架為主軸。
從防線設計,走到攻防對抗 8 月的《30 天用 GCP Security 打造企業級 AI 安全防線》,講的是「怎麼把防線設計對」——IAM 怎麼分層、資料邊界...
談攻防之前,先確定我們對 Agent 的定義一致 「Agent」這個詞在不同團隊嘴裡可能指完全不同的東西——有人說的 Agent 只是加了 function c...
用一套成熟的方法論,而不是憑感覺列風險 面對一個全新的攻擊面,最忌諱的是憑印象隨手列幾個「聽起來很危險」的風險項目。STRIDE 是資安界行之有年的威脅建模框架...
這五個陷阱不是憑空想像,是實際顧問案例裡反覆出現的模式 Day3 的 STRIDE 矩陣是一般化的威脅建模框架,這篇要收斂成五個更具體、更貼近企業實際導入經驗的...
複雜度不是線性增加,是指數增加 如果只有一個 Agent,IAM 權限設計相對單純:盤點這個 Agent 需要哪些工具、哪些資料存取權,套用 Day7(主題一)...
這週建立的是威脅地圖,不是防線本身 跟 8 月系列的 Week1 一樣,這週的角色是建立共同語言與威脅地圖,還沒進入具體的攻防演練——Day2 建立 Agent...
從「直接問」到「繞著問」 主題一 Day11 談過 Gemini API 的 Safety Settings,處理的多半是「使用者直接輸入惡意 Prompt」這...
這篇不是在講「模型變壞」,是在講「權限設計沒跟上」 Tool Abuse 談的不是模型本身想做壞事,而是 Agent 被誘導(不管是透過 Prompt Inje...
具備長期記憶的 Agent,能記住過去的對話、任務進度、甚至使用者偏好,這讓它的表現更連貫、更個人化。但這份記憶如果沒有妥善保護,就成了一個可以被慢慢污染的攻擊...
這篇談的是真實發生過的攻擊,不是假設情境 前面三篇談的是攻擊手法的原理,這篇用真實世界的案例把這些原理具體化。OpenClaw 是一個在 2025 年底爆紅的開...