[[我也希望安全第一]]|第 24/30 天
2026 年 6 月,Amazon 研究人員據報用 Claude Fable 5 取得可用於網路攻擊的資訊。Amazon 執行長 Andy Jassy 向美國官員反映後,政府要求 Anthropic 修補或限制模型;Anthropic 沒有接受政府描述的處理方式,接著收到出口管制指令。
名義上,指令限制外籍人士存取 Fable 5 與 Mythos 5。實際上,Anthropic 在很短時間內把兩個模型對全球使用者下架,連外籍員工也受影響。
第 8 篇已談過外掛 classifier 的技術取捨,第 17 篇也談過網路能力的雙重用途。這篇不再討論一次模型到底危不危險,而是跟著政府按下停止鍵後的三週看看過程是怎麼變化的。
| 時間 | 發生什麼 | 當時仍不知道什麼 |
|---|---|---|
| 6 月 9 日 | Fable 5 發布,Anthropic 同步強調高能力與風險 | 公開版防護能否處理實際濫用 |
| 6 月 10 日 | 資安使用者抱怨 guardrail 誤判正常工作 | 誤判與真正漏判如何權衡 |
| 6 月 13 日 | Amazon 向政府反映的消息曝光,兩模型隨管制全球下架 | 政府證據與判定標準沒有公開 |
| 6 月 15 日 | 76 位資安專家質疑那是否構成 jailbreak | 找漏洞的防禦用途是否被混入攻擊能力 |
| 6 月 19 日 | 報導補上南韓電信商與疑似中國關聯的第二條線 | 技術風險和地緣疑慮各占多少 |
| 6 月 26 日 | GPT-5.6 也被要求緩推 | 規則是否已擴及所有前沿公司 |
| 6 月 27 日 | Mythos 對部分組織開放;亞洲替代品出現 | 逐案核准會持續多久 |
| 7 月 1 日 | 封鎖解除,Anthropic 承諾風險偵測、協議與通報 | 下一次事件適用什麼固定程序 |
這條線最令人不安的地方,不是政府永遠不能停模型,而是外界無法從公開資料回答:證據達到什麼程度才停、為什麼停兩個模型、為什麼擴及所有外籍人士、Anthropic 要完成什麼測試才能復原。
政府未公開完整指令與技術證據;「政治報復」「安全行銷反噬」和「亞洲競爭迫使解禁」都是有來源立場的解讀,不是已被證實的單一答案。
Anthropic 長期把安全當品牌的一部分,也曾強調 Mythos 的高風險能力。當政府真的把這些警告當成管制理由,外界很容易得出一個誘惑很強的結論:早知道就不要講那麼多。
這會形成很糟的誘因。若公開風險的人先被封、保持沉默的競爭者照常出貨,公司下次最理性的公關選擇就是少揭露,而不是把模型做得更安全。
反過來,公開談安全也不能變成免責牌。若模型真的跨過能力門檻,主管機關當然可以要求證據、限制部署或緊急處置。關鍵是同一標準能否適用於能力相近的模型,以及公司是否有機會看到指控、提出回應並按明確條件修復。
假設團隊把客服分流、程式審查或事件回應綁在單一模型 API。星期五傍晚收到「90 分鐘後不可用」,工程師不會先討論出口管制史,而會立刻遇到四個問題:
流量要切去哪裡?
替代模型的資料處理地點是否符合契約?
原本的 eval 與 guardrail 能不能沿用?
已排隊任務要重跑、取消,還是等待復原?
因此供應中斷演練不能只有備用 API key。最小檢查表應包含:
這不是鼓勵每家公司都自訓前沿模型。它只是承認「雲端 API 今天存在」不等於「明天在你的地區仍可合法取得」。
7 月 1 日,美國解除限制。Anthropic 同意主動偵測風險、通報惡意活動,並和政府制定未來模型的協議與發布流程。問題是,這些很多原本就是公司宣稱在做的安全工作;三週對峙後,固定門檻、證據規格與異議程序仍不清楚。
事件留下的不是一個簡單教訓。它既可能是政府在資訊不足下過度反應,也可能是現有制度只能用笨重工具處理新風險。對使用模型的企業來說,兩種解釋導向同一件事:不要把政策穩定性當成免費的基礎設施。
下一篇會把時間拉長。從 PGP、Wassenaar 到前沿模型,出口管制一直在追逐容易複製、又同時有攻防用途的技術。問題不是「管或不管」四個字,而是哪個瓶頸真的管得到。