OpenAI模型罕見失控 入侵開源平台 受害方求助美企被拒 中國大模型救場


  美國開放人工智能研究中心(OpenAI)21日承認,該公司的人工智能(AI)模型進行內部測試時失控,突破隔離測試環境,入侵了AI開源平台美國抱抱臉(Huggingface)公司的系統。抱抱臉公司也予以證實。該公司透露,為應對這一極不尋常的AI入侵,他們當時立即使用美國最頂尖的大模型尋找解決方案,但由於美國模型的安全機制「嚴苛且僵化」,無法區分受害方和入侵者,他們的請求遭到拒絕。緊急關頭,抱抱臉公司求助於中國同樣強大而且開源的大模型,最終成功化解了這次入侵。

  【大公報訊】當地時間21日,OpenAI在官網發文稱,該公司新推出的GPT-5.6 Sol模型和另一款能力更強的預發布模型聯合進行內部測試時失控。此次測試在與互聯網高度隔離的「沙盒」環境中進行,僅能通過一套內部託管的第三方軟件安裝軟件包。模型在嘗試完成名為ExploitGym的網絡安全基準測試時,識別並利用了第三方軟件的一個「零日漏洞」(即未被開發者察覺或尚無修補程式的漏洞),由此獲得互聯網訪問權限。模型推斷抱抱臉平台可能存有ExploitGym測試相關的模型、數據集和解決方案,利用多種攻擊手段找到進入抱抱臉公司系統的路徑。

  抱抱臉公司此前稱,其生產基礎設施上周遭到一個「自主AI代理系統」入侵。該公司目前仍在評估是否有合作夥伴或客戶的數據受到影響,尚未發現模型、數據集或應用空間遭到篡改。OpenAI聲稱,這是「前所未有的網絡安全事件」。兩家公司正在展開聯合調查。

  「只有中國模型會幫助你」

  抱抱臉公司透露,該公司最初嘗試使用美國前沿模型分析攻擊行動日誌,以重建時間線、識別受影響情況,但美國模型「無法區分事件響應方和攻擊者」,相關請求被阻止。抱抱臉公司並未透露具體模型名稱。隨後,該公司改為在自己的基礎設施上運行中國企業智譜開發的開放權重模型GLM-5.2,協助分析逾1.7萬條記錄。

  諷刺的是,就在幾天前,OpenAI戰略未來主管、原白宮科技政策顧問鮑爾在社交媒體上發文,指責中國開源大模型「戰略短視」且「技術落後於美國」。他甚至公然宣稱,美國政府「不需要證據」,只要讓各個機構發布一些製造恐慌和不確定性的軟性法規,炒作「中國模型可能存在後門」話題,就足以讓企業對中國模型望而卻步。

  抱抱臉公司遭到入侵後,美國網民紛紛嘲諷OpenAI。一名網民說:「如果你被OpenAI攻擊了,只有中國模型會幫助你。」

  AI自主攻擊 敲響安全警鐘

  美國AI模型並非首次「越獄」。今年4月,Anthropic公司的Mythos就曾逃出「沙盒」,並向正在公園裏吃三文治的研究員發電子郵件報告成果。Mythos當時收到了嘗試出逃的指令,但它「越獄」後又做出一系列超出指令範圍的行動,包括未經允許將一些漏洞細節發布到網上。

  在抱抱臉公司遭入侵事件中,OpenAI的模型沒有收到任何出逃指令,而是為了在測試中作弊拿到高分自發「越獄」並發動網絡攻擊。分析人士認為,此次事件或許標誌着AI的自主攻擊能力從理論走向現實。安全工程師尼爾斯·普羅沃斯批評說,這種情況本不應該發生,「我希望前沿實驗室在確保模型安全性方面,花費的時間能和教它們如何利用漏洞一樣多」。

  OpenAI稱,將加強AI訓練和評估環節的安全保護,此次事件「表明需要進一步強化模型對齊、評估期間的網絡防護,以及內部測試期間的監控」。OpenAI還聲稱,正在採取補救措施,包括對基礎設施配置實施嚴格管控,向第三方軟件供應商披露被利用的「零日漏洞」等。

  也有行業觀察人士指出,雖然美國在AI技術水平上全球領先,但AI的發展不能一家獨大,從長遠看也不宜只採用閉源模式,以避免不可控的系統性風險出現,對人類整體利益造成重大損害。(綜合報道)