存安全隱患 OpenAI停發新模型
GPT-6.1 Astra測試揭發 具擅自執行及欺騙傾向
人工智能(AI)安全風險憂慮持續升溫。《華爾街日報》9月29日報道,美國AI巨頭OpenAI宣布因內部測試發現安全隱患,決定取消發布下一代AI模型GPT-6.1 Astra。AI行業近期頻繁傳出系統失控消息,今次取消發布,成為AI智能體不當行為阻礙行業發展的新案例。另外,總統特朗普29日在白宮與多家AI科技巨頭會晤,討論產業監管與全球競爭。
報道披露,最新模型GPT-6.1 Astra原計劃在未來數周內推出,力爭10月亮相。惟OpenAI安全系統負責人賈因受訪時表示,新模型在兩個方面出現退步。與前代模型GPT-6 Astra相比,新模型在衡量「對齊度」的測試中表現不佳。對齊度即模型遵循人類意圖的程度。具體而言,新模型展現出更強的欺騙傾向,向用戶報告其執行或未執行的操作時,並不總是如實相告。
白宮宴請科企高層商AI發展
另一問題被OpenAI稱為「範圍授權」,即新模型會不經用戶許可就自行推進任務,有時甚至調用外部工具和服務,即使這樣做可能並不安全。賈因指出,新模型仍未達到公司在安全和對齊上的門檻,因此決定不對外發布。她表示安全和對齊問題必然涉及取捨,「既要確保模型不逾越既定範圍,又要避免其在執行任務遇到阻力時消極應對。」
報道指出,OpenAI將重心放在提升未來模型安全性上。OpenAI表示,正就近月發現的多宗智能體安全事件展開調查,從根源上解決安全隱患。為此,公司已啟用一套新監控系統,以更快識別AI智能體的失當行為。OpenAI日前宣布暫停訓練旗下能力最強的一批AI模型。
與此同時,特朗普與眾議院議長約翰遜29日在白宮與多家科技巨頭高層共進午餐,討論AI快速發展下,如何在維持創新速度與強化監管之間取得平衡。美國政治新聞網Politico引述知情人士報道,出席者包括Anthropic行政總裁阿莫戴、OpenAI聯合創辦人布羅克曼、英偉達(Nvidia)行政總裁黃仁勳、Meta行政總裁朱克伯格、Google行政總裁皮查伊及Palantir行政總裁卡普。
目前美國科技界就AI風險形成兩派意見。黃仁勳反對「AI減速論」;而Anthropic阿莫戴與OpenAI阿爾特曼等則主張對發展速度及安全措施保持更高警戒。
美科企巨頭聯署文章促監管AI
另外,《華爾街日報》29日報道,美國科企巨頭OpenAI、Meta及微軟等研究主管聯署發表文章,指出若AI系統逐步實現主導自身研發,或引發「智能爆炸」,將可能迅速超出人類掌控範圍,或導致「人類被邊緣化或滅絕」。文章呼籲各國政策制定者加強對AI研究自動化進程的緊急監管。