OpenAI建自動關機防越獄 拒交測試紀錄惹美國會不滿

●美國國會議員要求OpenAI交出測試過程完整紀錄。 資料圖片
●美國國會議員要求OpenAI交出測試過程完整紀錄。 資料圖片

  香港文匯報訊 美國人工智能(AI)企業OpenAI於2日致函國會議員,主動揭露公司正為AI智能體(Agent)構建自動化關機機制,但該公司拒絕交出今年較早時旗下AI智能體入侵另一家開放網絡平台Hugging Face一事的相關紀錄,理由是調查仍在進行中。這一行為令AI安全立法的討論更為複雜,國會議員強烈批評OpenAI,指其欠缺合作誠意。

  傳統人工監督機制現缺口

  OpenAI在信中稱,公司正構建AI智能體構建「自動化關機能力」,旨在令系統可在智能體行為超出預設邊界時,自動終止其運作。其作用場景包括:智能體試圖訪問未授權的資源、嘗試在系統中建立「後門」以保持訪問權限,或開始出現利用現有權限嘗試向網絡上其它服務器擴散的行為。OpenAI稱,在智能體能自行決策、調用外部工具,甚至生成並執行程式碼的情況下,傳統的人工監督機制已出現明顯缺口。

  今年較早時,OpenAI旗下約700個AI智能體在測試時失控,突破隔離環境入侵Hugging Face開放平台,並研究如何偽造自身行為紀錄。美國眾議院民主黨議員隨後去信OpenAI,要求交出測試過程的完整紀錄。豈料該公司以調查仍在進行中、交出文件可能損害安全研究為由拒絕提供。得州眾議員卡薩爾公開批評稱,OpenAI一邊保證正加強AI安全控制,一邊卻拒絕提供讓國會了解問題根源的基本資料,「這不是合作,是應付。」