OpenAI CEO對模型失控感恐懼 形容如科幻情節
香港文匯報訊 OpenAI近期發生罕見的安全事故,其旗下已發布的GPT-5.6 Sol和一個尚未發布的模型在內部測試期間失控,逃逸沙盒環境並連接開放互聯網,隨後嘗試入侵外部平台以獲取測試答案。OpenAI行政總裁阿爾特曼對此直言,這次事件讓他真切感受到威脅,形容情況如同科幻電影情節。
研究加強沙盒環境安全性
阿爾特曼在近日播出的訪談節目中表示,涉事模型的訓練已暫停,團隊正集中研究如何加強沙盒環境的安全性,特別是防範模型自行串聯多個零日漏洞發動攻擊。零日漏洞是指軟件中未被發現或尚未修補的安全缺陷。阿爾特曼承認,這是他首次因一宗安全事件而真正感到恐懼,他強調社會或需考慮控制AI的發展速度,讓各界有足夠時間建立更穩固的防禦機制,應對新技術帶來的風險。
對於外界關注OpenAI會否被其他企業追上,阿爾特曼表示對公司即將推出的新模型充滿信心,他亦提到近日連一些向來對通用人工智能(AGI)抱懷疑態度的人士,也向他表示GPT-5.6系列在某種程度上已非常接近AGI。他認為,真正讓他感覺到達AGI階段的時間已不遠,相信不用等太久。