剛剛,Anthropic 發布聲明稱,美國政府以國家安全為由,下達出口管制指令,要求暫停所有外國公民訪問 Fable 5 和 Mythos 5。
甚至連Anthropic 內部的外籍員工,也被納入限制范圍。
Anthropic稱,會遵照政府的法定指令,關停所有用戶對Fable 5和Mythos 5的訪問權限。
但同時表示,對于美國政府“僅憑發現一種局限性較強的潛在破解手段,就下架面向數億用戶的商用模型”的做法,“我們并不認同”。
![]()
以下為聲明全文:
美國政府援引國家安全部門相關意見,發布出口管制指令,禁止所有外籍人士(無論身處美國境內還是境外)使用Fable 5與Mythos 5模型,Anthropic公司外籍員工也在限制范圍內。
為遵守該指令,我們不得不立即為全體用戶關停上述兩款模型,Anthropic旗下其他所有模型的使用權限均不受影響。
美國東部時間今日下午5點21分,我們收到了這份政府指令,文件并未詳細說明具體的國家安全隱患。
據我們了解,美方稱發現了可繞過Fable 5安全防護機制(即“越獄破解”)的方法。我們查看了相關演示,該手段僅能找出少量此前已被發現的輕微漏洞。
這些漏洞本身難度較低,市面上其他公開模型無需破解也能檢測出同類問題。
結合產品上線博客中的說明,Anthropic針對Fable系列模型的安全防護立場如下:
我們為Fable設置了嚴密的安全防護機制,大幅降低其被濫用于網絡安全相關違規操作的風險。
事實上,這套防護規則限制范圍較廣,不少用戶也曾對此提出不滿。
在Fable正式上線前數周,Anthropic聯合美國政府、英國人工智能安全研究所、多家第三方機構及內部團隊,對Fable的安全防護體系開展了累計數千小時的攻防測試。
測試結果證明,Fable的安全防護效果遠優于以往所有已落地的模型。
截至目前,測試人員尚未找到通用破解手段——也就是能夠大范圍繞過模型防護、解鎖各類網絡攻擊能力的越獄方法。
我們認為,現階段沒有任何一家模型廠商能做到徹底防范越獄破解。行業內所有防護機制都無法規避非通用型破解手段(這類手段僅能在特定場景下獲取部分網絡相關信息),且未來終究會出現通用破解方法。我們在發布Fable 5時就已明確說明這一點。
鑒于當下無法實現絕對防破解,Anthropic為Fable 5采用了縱深防御策略:
一方面讓非通用型破解手段的作用范圍受限,另一方面大幅提升研發通用破解手段的成本;同時搭配全流程監控,一旦發現破解攻擊行為,可第一時間識別并阻斷。
這也是我們要求留存用戶使用Fable相關數據30天的原因。這項政策調整給公司和用戶都帶來了實際成本,但能幫助我們研究破解手段并進行風險修復。
我們始終堅持這套縱深防御策略。該策略有效管控了Fable的潛在風險,使其風險水平與行業內現有已投入使用的主流模型持平。
目前,我們并未收到任何會造成危害的非通用型破解漏洞通報。已向我們披露的相關破解嘗試,要么只會生成無害內容,要么只是一些無關緊要的小問題,并不會對Mythos模型造成針對性威脅。
迄今為止,美方僅口頭告知我們存在一種范圍有限的非通用型破解方式,其原理大致是指令模型讀取特定代碼庫并修復軟件漏洞。
據悉,相關破解案例已提交至美國政府。我們核查了這份作為本次管制指令依據的報告,確認報告中展現的能力,其他主流模型(包括OpenAI的GPT-5.5)均已具備,網絡安全防護人員日常也一直在使用同類功能。未來24小時內,我們會公布更多細節。
我們將遵照政府的法定指令,關停所有用戶對Fable 5和Mythos 5的訪問權限。
但我們并不認同:僅憑發現一種局限性較強的潛在破解手段,就下架面向數億用戶的商用模型。倘若全行業都執行這一標準,前沿AI模型廠商的新模型落地工作基本都會陷入停滯。
我們此前公開表態過,支持政府依據透明、公平、規則清晰、以技術事實為依據的法定流程,叫停存在安全隱患的模型上線。但本次管控舉措并不符合上述原則。
對于此次服務中斷,我們向所有用戶致歉。我們認為這是一場誤解,目前正全力推進相關工作,爭取盡快恢復模型訪問權限。
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.