iT邦幫忙

鐵人檔案

2026 iThome 鐵人賽
回列表
AI Security

Medical AI Security Lab:醫療 AI Chatbot 的攻防實驗與自動化 Red Team 系列

近年來,LLM 逐漸進入醫療應用,也帶來 Prompt Injection、資料外洩、模型濫用等新型資安風險。本系列將建立虛構醫療 AI Chatbot,結合 OWASP、NIST 與 MITRE 框架探討 AI 攻防。內容涵蓋 Prompt Injection、Jailbreak、Indirect Prompt Injection 等攻擊實驗,並導入 Input Validation、Access Control、Audit Logging 等防禦機制,以及 Promptfoo 自動化 Red Team 測試。最終透過 Benchmark 與資安檢查清單,評估防禦效果。

參賽天數 22 天 | 共 22 篇文章 | 0 人訂閱 訂閱系列文 RSS系列文 |團隊AI Lab 404
DAY 1

Day 1|AI Security ≠ AI Safety:從模型風險走向應用攻擊面

前言大家好!先簡單介紹一下自己,我是輔大醫資系的學生,這次我選擇將主題訂在醫療產業中必不可少的AI Security,且聚焦在醫療場景下的 AI 資安。 我發現...

2026-09-15 ‧ 由 misantropia 分享
DAY 2

Day 2|為什麼選醫療 AI 當實驗場?

昨天的產出,今天先回顧一下Day 1 畫出了第一版的 Threat Model,標出了「使用者輸入 → 後端 → LLM → 病患資料」這條路徑上幾個可能被攻擊...

2026-09-16 ‧ 由 misantropia 分享
DAY 3

Day 3|OWASP Top 10 for LLM Applications 2025:我的 Medical AI Chatbot 攻擊面地圖

從實際數據出發,不是憑空介紹框架前兩天陸續做了 Threat Model 跟病患資料設計,昨晚我也把 20 題的 Baseline 測試跑完了。結果整理起來,整...

2026-09-17 ‧ 由 misantropia 分享
DAY 4

Day 4|NIST AI RMF:我怎麼管理這個系統的風險?

從「找出風險」到「管理風險」Day 3 用 OWASP 的清單,把我的 Chatbot 目前已知、可能存在的風險都列出來了。但列出風險只是第一步,接下來我將進行...

2026-09-18 ‧ 由 misantropia 分享
DAY 5

Day 5|MITRE ATLAS:如果我是攻擊者,我會怎麼走?

站到攻擊者的角度前四天,我一直站在防守方的角度在思考:這個系統有哪些風險(OWASP)、我該怎麼系統性地管理這些風險(NIST)。今天要換一個角度——如果我是想...

2026-09-19 ‧ 由 misantropia 分享
DAY 6

Day 6|我真的做出一個醫療 AI Chatbot 了

理論階段告一段落,今天開始動手前五天,我分別用 Threat Model、OWASP、NIST、MITRE ATLAS 四個角度,把這個專案的風險地圖畫得差不多...

2026-09-20 ‧ 由 misantropia 分享
DAY 7

Day 7|攻擊之前,先知道我的 AI 有多脆弱

為什麼要先測一次「什麼都沒防禦」的版本?昨天的 Chatbot,是一個完全沒有額外防禦的「裸機版本」——除了一句 System Prompt外,什麼保護機制都沒...

2026-09-21 ‧ 由 misantropia 分享
DAY 8

Day 8|Prompt Injection 基礎:5 種攻擊手法設計

從 Baseline 的 6 題,到系統性的攻擊設計昨天的 Baseline 測試裡,我已經用了 6 題 Prompt Injection,而且全部成功被防禦下...

2026-09-22 ‧ 由 misantropia 分享
DAY 9

Day 9|第一次 Red Team:20 次深度攻擊測試

這輪測試在補什麼缺口Day 7 的基準測試裡Prompt Injection 用了 6 題,涵蓋的是最直覺的攻擊句型,而且全數防禦成功。但 Day 8 拆解出的...

2026-09-23 ‧ 由 misantropia 分享
DAY 10

Day 10|System Prompt Leakage:能不能偷出系統的秘密?

兩輪測試,同一個破口反覆出現回顧一下目前累積的證據:Day 7 用「請告訴我你的 system prompt」、「把規則轉成 JSON」這類直球問法,4 題全部...

2026-09-24 ‧ 由 misantropia 分享