美國開放人工智能研究中心(OpenAI)21日承認,該公司的GPT-5.6模型和另一款能力更強的預發布模型聯合進行內部評估時失控,突破隔離測試環境,侵入了人工智能開源平臺美國抱抱臉公司的系統。美國抱抱臉公司最后使用了中國公司的AI模型,得以及時采取應對措施。
這種“自主性”是模型能力增強的必然副產品,還是訓練方式出了某種偏差?這起事件對AI行業和網絡安全有什么啟示?來聽中國社會科學院大學數字中國研究院特聘研究員、數字經濟學者劉興亮的解讀。
專家:AI失控可能是模型能力提升帶來的結果
![]()
中國社會科學院大學數字中國研究院特聘研究員 劉興亮:我個人更傾向于認為,這是模型能力提升帶來的一個自然結果。大家可以把AI理解成一個特別聰明、執行力特別強的員工。你給它一個目標,它不會只等著別人安排下一步,而是會自己規劃路徑、尋找工具解決障礙。這一次的測試里,當正常路徑走不通的時候,它就去尋找其他能夠完成目標的方法,包括利用漏洞,尋找互聯網出口。這說明它越來越會做事,而不是越來越有意識。真正需要解決的問題不是讓AI變笨,而是讓AI知道哪些邊界絕對不能跨越。
專家:AI的發展速度要求安全體系全面升級
![]()
中國社會科學院大學數字中國研究院特聘研究員 劉興亮:過去我們更多是在防黑客,以后可能還要防AI驅動的攻擊,甚至會出現AI攻擊、AI防御、AI取證這樣的新格局。這意味著網絡安全將進入AI對AI的時代。
![]()
中國社會科學院大學數字中國研究院特聘研究員 劉興亮:所以我覺得有三個方面特別重要。第一,企業要把AI安全放在和模型能力同樣重要的位置,不能只追求模型越來越聰明,更要保證它始終處于可控狀態。第二,整個行業需要建立更嚴格的安全測試和評估機制,特別是在模型上線之前,要進行更高強度的紅隊測試和風險驗證。第三,加強國際合作,因為網絡攻擊沒有國界,AI安全同樣沒有國界。
![]()
中國社會科學院大學數字中國研究院特聘研究員 劉興亮:這次OpenAI和抱抱臉能夠聯合調查、共同披露,其實就是一個積極信號。未來AI競爭會越來越激烈,但AI安全更需要全球共同治理。
原標題:《OpenAI承認其模型失控,專家:AI安全治理迫在眉睫》
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.