當地時間21日,美國人工智能公司OpenAI對外披露,旗下部分AI模型在一次內部安全測試中失控,突破隔離環境并入侵開源AI平臺的基礎設施。OpenAI稱這是“一起前所未有的網絡事件”。讓美國網友吃驚的是,救場的居然是中國的人工智能。
OpenAI突發
大模型失控,出現入侵事件
OpenAI在21日承認,該公司的GPT-5.6 Sol模型和另一款能力更強的預發布模型聯合進行內部評估時失控,突破隔離測試環境,侵入了Huggingface的系統。
OpenAI在官網發文說,此次內部評估在與互聯網高度隔離的“沙箱”環境中進行,僅能通過一套內部托管的第三方軟件安裝軟件包。模型在嘗試完成名為ExploitGym的網絡安全基準測試時,識別并利用了第三方軟件的一個“零日漏洞”,由此獲得互聯網訪問權限。模型推斷Huggingface可能存有ExploitGym測試相關的模型、數據集和解決方案,利用多種攻擊手段找到進入Huggingface系統的路徑。
OpenAI安全團隊發現內部異常活動,Huggingface安全團隊在其基礎設施上檢測到并阻止相關活動,雙方正在展開聯合調查。
通俗的解釋就是,根據OpenAI的說法,這起史無前例的人工智能入侵事件,源于公司上周在內網對自家兩款頂尖大模型進行能力測試。可測試中的大模型為了通過作弊取得更高的測試分數,竟然搞到了接入互聯網的權限。隨后它便徹底“放飛自我”,入侵了Huggingface的后臺系統,希望從Huggingface的數據庫里找到作弊的辦法。
OpenAI7月9日正式推出GPT-5.6系列模型,OpenAI此前稱,在安全方面,GPT-5.6系列模型配備了該公司迄今最穩健的安全防護措施,在生物和網絡安全方面的能力強于此前模型。
![]()
中國人工智能救場
Huggingface在上周的一份聲明中稱,為了應對這一極不尋常的人工智能入侵,他們立刻使用美國最頂尖的人工智能大模型尋找解決方案。可當Huggingface將自身遭入侵的信息提交給這些美國閉源大模型時,對方卻拒絕幫助。因為這些閉源大模型的安全機制過于嚴苛和僵化,無法區分描述案情的受害者和實施入侵的作案者,選擇了“一刀切”。
緊急關頭,Huggingface想到了中國同樣強大,而且開源的大模型。于是,該平臺立刻在本地部署了中國企業智譜AI開發的GLM5.2大模型,并在這款中國模型的幫助下,成功化解了這次入侵。
據公開資料,GLM 5.2發布于今年6月中旬。GLM 5.2上線首周,日均詞元調用量就增長了27倍、客戶數增長80倍。近日,智譜已落地1GW級國產AI算力數據中心建設,并全部采用國產AI芯片。
目前,上述人工智能失控事故已經在美國的網絡上炸開了鍋。有美國網友表示,這簡直就是科幻電影《終結者》中人工智能失控后攻擊人類的一次預演。讓更多美國網民震撼的,還是此事中美國頂尖的大模型拒絕提供幫助,最后得靠中國的開源大模型去對抗失控的美國閉源大模型的情節。
![]()
![]()
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.