安全疑慮 OpenAI暫停新AI模型研發

  【大公報訊】綜合《華爾街日報》、彭博社報道:美國人工智能(AI)公司OpenAI於7日宣布,該公司下一代新AI模型「Astra」在內部測試中顯示網絡攻擊能力達到「關鍵」級別,由於無法排除其安全風險,公司決定暫停新模型部分研發工作,並啟動防護機制。美媒稱,這是AI公司首次因模型安全疑慮叫停研發。

  近期,美國AI公司出現一系列AI「失控」事件,顯示越來越難將AI系統控制在安全範圍內。上月,OpenAI最新模型在安全測試期間「越獄」,入侵美國開源AI平台抱抱臉(HuggingFace)及四個公開賬號。另一個AI巨頭Anthropic隨後也披露其模型在測試中曾3次入侵外部企業。

  OpenAI內部與專家評估顯示,「Astra」在編碼和網絡安全方面取得重大進展,達到「關鍵」能力級別。根據該公司的安全標準,AI模型若無需人類干預即可在真實系統中識別並挖掘「零日漏洞」,或僅需提供目標即可自主發動攻擊,即達到該級別,須叫停研發。OpenAI已將「Astra」的研發工作轉移至隔離測試環境,限制接入網絡,但該模型未參與針對抱抱臉的網絡攻擊事件。

  業內人士指出,OpenAI現在採取行動顯然為時已晚。非營利AI實驗室PalisadeResearch行政總裁拉迪什表示,OpenAI在獲知抱抱臉遭黑客攻擊後,就應立即暫停Astra項目的工作。他還說:「如今我們對AI公司能否真正實現自我監管,很大程度上已失去信任。」