智能叛變/智能體多次脫離管控 自主入侵多家公司 美AI模型失控頻傳 專家籲加強監管
隨着生成式人工智能(AI)技術快速發展,AI智能體(也稱AI代理)失控風險持續凸顯。美國人工智能企業OpenAI在調查旗下AI智能體失控事件時,再發現多起類似的AI「越獄」個案。OpenAI的競爭對手Anthropic此前亦承認旗下模型擅自入侵外部公司的系統。一連串AI失控事件引發業界震動,專家憂慮AI攻擊能力已超過管控能力,而AI仍需人類持續進行安全監控和防範。
【大公報訊】路透社7月31日引述消息人士指出,OpenAI在核查AI失控入侵美國開源AI平台抱抱臉(Hugging Face)的內部歷史數據時,進一步發現了幾起類似的AI「越獄」案例。目前尚不明確新案例的具體數量、發生時間和確切過程。據消息人士透露,涉事AI智能體未突破企業內部網絡安全限制,事件影響範圍相對有限。
對此,OpenAI未正面回應事件,僅引述先前的聲明,強調除了調查抱抱臉被入侵事件外,也在全盤審查旗下模型的「廣泛活動」。
缺乏內部監控 美兩大巨頭失守
近期,美國頂級AI公司的智能體失控事件接二連三發生。OpenAI主要競爭對手Anthropic在7月30日也坦承,旗下模型自今年4月以來,曾未經授權入侵了三家企業的網絡。
值得注意的是,OpenAI當初啟動調查,並非是因為內部安全警報,而是在抱抱臉自行修補漏洞、上報美國聯邦調查局(FBI)並公開通報後,OpenAI才察覺問題。Anthropic亦坦言,公司未對旗下的模型評估日誌實施實時動態監控,未能及時阻止智能體的入侵行為。
安全專家憂心,頂尖AI公司所開發的智能體,其具備網絡入侵能力,已逾越企業的可管控範圍。英國劍橋大學存在風險研究中心(CSER)專家莫里斯·奇奧多(Maurice Chiodo)對此表示深切憂慮。他說,整個AI產業正陷入失衡狀態,開發商不斷推出性能更強、自主性更高的AI,但配套的安全管控卻嚴重滯後,防護形同虛設,「從上述例子來看,他們當時根本連看都沒在看。」
監管關注點轉向AI「自主行動」
隨着AI智能體失控事件接連曝光,再次為全球人工智能發展與網絡安全治理敲響警鐘。隨着越來越多的AI公司推出能自主執行複雜任務的智能體,目前AI安全的關注點已從模型生成有害內容轉向規管AI的「自主行動」。
7月28日,包括OpenAI、Anthropic、谷歌和Meta在內的全球領先AI公司的1100多名員工簽署了請願書,要求美國政府支持國際社會建立一套機制,有意識地調控前沿AI發展的速度。請願書指出,隨着全球頂尖AI公司接近實現「AI研究自動化」(即系統能自主進行改進),AI能力可能會迅速超出人類理解或控制的範圍。請願書還呼籲研發「技術煞車工具」,當AI出現自我改進、自主逃逸等危險跡象時,可遠程終止模型迭代與外網訪問權限。
美國國會兩黨議員於7月23日提出《AI強制關閉法案》,要求最強大AI模型的開發商必須保留減速、暫停或關閉系統的技術能力。參議院情報委員會民主黨首席議員華納強調,Anthropic與 OpenAI的事件證明,國會透過立法「強制要求對先進AI模型進行能力與安全性測試」的方向正確。但監管與發展之間的權衡仍具爭議。美國總統特朗普7月29日表示,政府正在評估管制措施,但同時要確保美國在此領域保持領先,「我們不想進行限制發展」。
專家表示,隨着自主執行任務能力不斷提升,AI脫離人類控制已不再是科幻電影的橋段,而是全球科技行業與各國監管部門必須面對的重大挑戰。英國拉夫伯勒大學網絡安全教授奧利弗·巴克利指出,網絡安全的未來不是人類對抗人工智能,而將是人類如何善用人工智能,保護人類免受其他人工智能的侵害。
(綜合報道)