2026 年 6 月 12 日,Anthropic 收到美國政府的一紙命令:基於國家安全授權,要求暫停所有外國人士(包括公司內部的外籍員工)對 Fable 5 與 Mythos 5 的存取。Anthropic 別無選擇,只能立即對所有客戶停用這兩個模型。這不是一次普通的產品更新,而是 AI 監管與安全辯論中的一個關鍵時刻。
政府說了什麼,Anthropic 又怎麼回應
根據 Anthropic 的官方聲明,政府並未在信函中說明具體的國安疑慮,僅口頭表示發現了一種「越獄」Fable 5 的方法。Anthropic 事後審查了政府提供的示範,發現該技術僅能找出少數「先前已知、且相對輕微」的漏洞,而且其他公開模型(如 OpenAI 的 GPT-5.5)不需越獄也能發現這些漏洞。
Anthropic 強調,他們在 Fable 5 上市前已與美國政府、英國 AISI 及多家第三方機構合作,進行了數千小時的紅隊測試,結果顯示 Fable 的防護遠優於任何先前部署的模型,且至今無人能找到「通用越獄」——一種能廣泛繞過所有防護的方法。Anthropic 也承認,完美的越獄防護在當前技術下並不存在,因此他們採取「縱深防禦」策略:讓越獄變得狹窄或成本高昂,並搭配嚴密監控。
爭議核心:監管標準與產業影響
Anthropic 的聲明點出一個尖銳問題:如果政府僅憑一個「狹窄、非通用」的越獄就要求召回商業模型,那麼「這個標準若套用到整個產業,基本上會讓所有前沿模型的部署停擺」。他們認為,政府應該有權阻止不安全的部署,但必須透過「透明、公平、清晰、基於技術事實」的法定程序,而這次行動顯然不符合這些原則。
這起事件凸顯了 AI 監管的兩難:一方面,政府有責任防範國家安全風險;另一方面,若監管缺乏明確技術依據,可能扼殺創新,並讓企業無所適從。Anthropic 的立場是,他們已盡力做好安全措施,且該越獄並未造成實際危害,因此政府的決定「基於誤解」。
對產品開發者的啟示
對於正在打造 AI 產品的團隊,這起事件有幾個值得深思的點:
- 安全不是絕對的:Anthropic 的案例顯示,即使投入大量資源做紅隊測試,仍無法保證零漏洞。開發者應務實看待安全,採用分層防禦,而非追求不切實際的完美。
- 監管合規是現實成本:Anthropic 為了配合安全監控,已要求客戶資料保留 30 天,這對客戶關係造成實際成本。未來,類似的合規要求可能成為常態,產品設計需提前納入考量。
- 溝通與透明度至關重要:Anthropic 在第一時間公開聲明,詳細說明技術細節與立場,這有助於維繫客戶信任。面對監管壓力時,清晰的溝通是企業的關鍵資產。
後續觀察
Anthropic 表示將在 24 小時內公布更多細節,並強調會「盡快恢復存取」。這起事件是否會成為 AI 監管的轉捩點,取決於政府是否提出更明確的技術證據,以及產業界如何回應。對開發者而言,這是一個提醒:AI 產品不再只是技術競賽,監管與政策將越來越深地影響產品生命週期。
參考來源
本文由 AI 協助自上述來源整理,經人工審核後發布。
