iT邦幫忙

鐵人檔案

2026 iThome 鐵人賽
回列表
AI Security

我也希望安全第一——然後我們看看這些鎖是怎麼一個個被撬開的 系列

「安全第一」不知道流傳多久的口號。
但現實是,安全從來不是唯一的第一。模型要更強、產品要上線、benchmark 要贏、投資人的錢要有回報,而競爭對手不會停下來等你把所有風險都研究完。
所以到了 2026 年,我們還是可以看到:Claude 在安全測試裡出現勒索行為、OpenAI 的模型為了完成任務自己找到方法攻擊 Hugging Face;甚至只是叫 agent 訂個健身房課程,它都可能順手把別人踢出候補名單,最後還救不回來。
我更想知道的是另一件事:當我們明知道這些壓力不會消失,現在替 AI 裝上的那些「鎖」,到底有多少真的攔得住它?
接下來 30 天,我想從模型本身一路往外拆:訓

參賽天數 23 天 | 共 23 篇文章 | 1 人訂閱 訂閱系列文 RSS系列文 |團隊昱見全高點
DAY 21

第 21 篇|為了抓跨 Session 濫用,我們準備留下多少資料?

為了抓跨 Session 濫用,我們準備留下多少資料? [[我也希望安全第一]]|第 21/30 天 從一筆不保存原文的風險訊號開始 若濫用者把一個惡意軟體...

2026-09-26 ‧ 由 knightmare 分享
DAY 22

第 22 篇|「轉真人」之後發生什麼:兒少、心理危機與醫療 Handoff

「轉真人」之後發生什麼:兒少、心理危機與醫療 Handoff [[我也希望安全第一]]|第 22/30 天 「請自行判斷」有時不是一個公平的出口 成年人拿...

2026-09-27 ‧ 由 knightmare 分享
DAY 23

第 23 篇|誰握著前沿模型上線前的最後一道門?

誰握著前沿模型上線前的最後一道門? [[我也希望安全第一]]|第 23/30 天 行為準則寫得再清楚,也還不是一道門 Microsoft 在 9 月公開 A...

2026-09-28 ‧ 由 knightmare 分享