金融法務部門是機構內個資密度最高的單位——契約、判決書、客訴信裡不只有身分證字號,還有大量第 6 條特種個資。當這些文件要交給 LLM 處理,「不能外洩」就從原則變成架構問題。
這 30 天會完整走一遍 LLM 個資防護閘的設計:PII 偵測的規則層與語意層、去識別化三種手法的取捨(只有一種可逆)、Token Vault 的隔離與可控還原、OCR 與非結構化文件的處理,最後用紅隊驗證整套架構。
一個簡單的問題 偵測引擎逾時了。使用者的文件正等著處理。系統應該: A. 擋下來,告訴使用者「系統忙碌,請稍後再試」。 B. 放行,把原文送給模型,先讓使用者有...
從 Day 3 那個伏筆說起 Day 3 的威脅模型裡,我把 Prompt Injection 放在「模型互動」那一段,然後留了一句話: 如果 Injecti...
它是什麼 Model Armor 是 Google Cloud 的模型輸入輸出篩查服務。它獨立於模型本身,可以檢查送進模型的 prompt 和模型吐出的 res...
換一個攻擊者視角 前兩天的攻擊目標是「讓個資漏出去」。今天的目標不同:個資已經被正確 Token 化了,攻擊者要把它還原回來。 最直接的方法是偷 Vault。但...
為什麼需要「一票否決」的概念 一般的系統驗收是打分數:功能覆蓋 80%、效能達標、可用性 99.9%,加權平均過門檻就通過。 資料防護系統不能這樣驗。因為某些失...
一次性的紅隊沒有意義 滲透測試報告的半衰期很短。測完之後: 規則改了 模型換了新版本 加了新的文件類型 有人為了修 bug 動了 fail 策略 每一個改動...