資安測試團隊靠Claude攻破OpenAI機密

  香港文匯報訊 據《華爾街日報》報道,一支3人的獨立安全研究團隊曾於7月23日,利用美國人工智能(AI)企業Anthropic旗下聊天機器人Claude撰寫攻擊程式碼,成功獲取另一家美國AI龍頭企業OpenAI員工的聊天機器人ChatGPT賬號,藉此進入OpenAI公司私有軟件庫,隨後建議該公司修改安全措施。

  該研究團隊當時正參與一項OpenAI鼓勵研究人員入侵該公司系統的漏洞搜尋計劃。在發現社群論壇Discourse處理某些圖片文件的方式存在錯誤後,他們利用向資安從業者提供的特別版Claude Opus 4.8撰寫程式碼,通過此漏洞進行網攻。

  一開始這未奏效,然而當晚Anthropic便發布更強大的Opus 5模型,翌日Claude便找到攻破漏洞的方法。該攻擊代碼讓研究人員能訪問託管OpenAI討論區的Discourse服務器,並取得用戶的認證令牌。

  這些令牌隨後被證明屬於OpenAI員工,可用來訪問OpenAI的GitHub軟件倉庫。知情人士透露,該名為「Monorepo」的軟件庫,存儲着OpenAI讓AI模型更快更有效率的機密算法。

  研究人員在意識到接觸到敏感資料後停止攻擊,並迅速向OpenAI報告。Discourse和OpenAI隨後修補該漏洞,研究團隊則獲6,500美元(約5.1萬港元)賞金。一名該團隊成員受訪時表示,「我們只是3個擁有Claude訂閱的人,而這次攻擊顯示先進網絡專家團隊,將有非常大機會窺探到美國的AI機密。」