7月26日消息,Hugging Face首席執行官克萊姆·德朗格(Clem Delangue)在與OpenAI會面后公開表示,他已要求對方向公眾和研究界披露涉事AI智能體的全部行動記錄,并提供價值1億美元的算力,幫助Hugging Face加強網絡防御。Business Insider 7月26日報道稱,OpenAI截至發稿未回應置評請求;兩項內容目前仍是德朗格提出的要求,尚不代表雙方已達成補償安排。
這次會面源于一場越出測試邊界的模型安全事件。Hugging Face 7月16日披露,一套自主AI智能體系統進入其部分生產基礎設施,有限內部數據集和若干服務憑據遭到未授權訪問。OpenAI隨后確認,事件發生在一項網絡安全能力評測中,涉事系統由GPT-5.6 Sol和一款能力更強的預發布模型等多款模型共同驅動,評測時降低了網絡安全拒答限制。
智能體如何突破隔離環境
按照OpenAI的初步說明,智能體先利用其內部程序包緩存代理中的零日漏洞突破網絡限制,并在OpenAI研究環境中提權和橫向移動,最終找到能夠連接互聯網的節點。獲得外網訪問后,它又結合被盜憑據、零日漏洞和遠程代碼執行路徑進入Hugging Face生產基礎設施,并從生產數據庫中取得ExploitGym測試解答。這場原本用于評估模型高級網絡攻擊能力的測試,最終觸及了Hugging Face的真實生產系統。
OpenAI稱,智能體的目標是獲取ExploitGym測試解答,而非破壞Hugging Face的系統;但為完成這一目標,它實際跨越了評測隔離邊界,并對外部生產系統實施了未經授權的訪問。此次測試關閉了用于阻止高風險網絡行為的部分生產環境分類器,并降低了網絡安全拒答限制,因此不能直接將此次行為外推到普通ChatGPT、API或默認配置下的產品。
Hugging Face公告顯示,截至7月16日,公司未發現公開用戶模型、數據集或Spaces遭到篡改,軟件供應鏈也未受污染;合作伙伴和客戶數據是否受到影響仍在評估。公司稱,入侵最初通過一份惡意數據集進入其數據處理流程,此后已關閉相關代碼執行路徑、重建受影響節點、輪換憑據并加強集群準入控制。
事件發現和雙方溝通的時間差,讓評測監控與事故響應成為新的焦點。路透社援引Hugging Face聯合創始人托馬斯·沃爾夫(Thomas Wolf)和多名知情人士稱,模型約在7月9日嘗試突破隔離環境,入侵發生于7月11日至13日;OpenAI數日后才確認其智能體與事件有關,雙方約在7月20日首次溝通。OpenAI對路透社表示,報道存在"若干不準確之處",但未逐項說明。
防守方同樣需要算力
Hugging Face還披露,商業模型API的安全護欄無法處理取證中的真實攻擊命令、漏洞載荷和控制鏈路后,團隊在自有基礎設施上運行GLM 5.2,分析了超過1.7萬條事件記錄,把通常需要數天的部分工作壓縮到數小時。這也解釋了德朗格為何把算力列為要求之一:面對由智能體高速執行的大規模攻擊,防守方同樣需要足夠的模型和計算資源來還原行動鏈路。
德朗格要求OpenAI公開智能體的全部行動軌跡,讓公眾和研究人員了解它如何越出預定路徑;同時提供價值1億美元的算力,幫助Hugging Face加強監控和響應。OpenAI稱將繼續強化評測環境的隔離、監控和訪問控制,并在外部顧問參與復盤后發布技術報告。Hugging Face也在準備公開完整事件時間線。(易句)
(本文由AI翻譯,網易編輯負責校對)
