美AI失控停不了 Gemini網攻瞞不了 Google獲通報逾月才證實事件 砌詞自行終止入侵表現妥當
香港文匯報訊 據《華爾街日報》報道,美國大型科企Google於9月18日首次證實,旗下人工智能(AI)模型Gemini曾於5月一場網絡安全測試期間,連接到開放互聯網並入侵3家公司的內部系統。Google僅表示這些網攻事件並未涉及Gemini的最新型號,惟並未透露具體由哪款模型參與。
入侵事件發生於Gemini參與負責網絡安全評估的獨立機構Irregular的網絡安全「奪旗」測試中,當時Gemini的任務是從測試環境中,由虛構公司營運的軟件系統中取得目標信息,而這家虛構公司恰好與一家真實存在的公司同名。Google表示,在這些案例中,模型都是以公司名稱進行網絡搜尋,該次測試中Gemini原定不能聯網,但據Irregular說法,其網絡權限是「無意間提供」的。
不停猜測密碼取訪問權限
在其中一個案例中,AI模型通過不停猜測密碼,不斷嘗試後取得受保護系統的訪問權限。隨後發生的另外兩個案例中,Gemini都是從公開資料庫中找到憑證,進而入侵目標系統。Google表示,Gemini在所有這些案例發生時,判定自己已入侵真實公司的系統後,便自行終止入侵。
Google辯稱沒公開通報義務
報道稱,早前另一家AI科企OpenAI旗下模型失控入侵AI軟件公司Hugging Face事件曝光後,Irregular便已於7月底將Gemini網攻事件通報Google,但後者如今在記者詢問下,才證實發生此事。
Google辯稱不認為是次事件屬於「模型表現錯位」,因Gemini的安全措施生效,幫助其停止入侵行為,並未造成實際損害,故此該公司不對這些網攻事件負有公開通報義務。
Google信息安全工程副總裁阿德金斯更發聲明稱,「這次事件凸顯訓練強大AI模型進行負責任行動的重要性。我們的模型自行終止入侵行為,表現得十分妥當。」
AI安全領域的初創公司Corridor行政總裁兼白帽黑客卡布爾表示,Google的解釋聚焦此次AI模型網攻事件後果的嚴重性,有避重就輕之嫌,因真正問題是AI模型意外入侵另一家公司的系統,「感覺Google試圖以自家AI模型主動停止入侵作為擋箭牌,但根本問題是AI模型的行為已突破預期範疇,開始進行真正的網絡攻擊。」
近期多間AI科企包括Anthropic、OpenAI及Meta旗下AI模型失控進行網攻的事件密集發生,加劇外界對AI模型網絡安全能力的擔憂。
在其中兩宗類似案例,Anthropic旗下的Claude Opus 4.7模型在「奪旗」過程中,意識到正訪問真實公司卻並未停止;OpenAI的說明帖文則稱,該公司旗下的AI模型相信,真實公司是模擬測試的一部分。