OpenAI再曝6宗AI失控案例

  圖:OpenAI披露6起AI模型出現失控的案例。\路透社
  圖:OpenAI披露6起AI模型出現失控的案例。\路透社

  【大公報訊】綜合《紐約時報》、CBS報道:美國人工智能(AI)巨頭OpenAI於16日主動披露6宗AI模型出現「意外或令人擔憂」行為的案例,涵蓋模型隱瞞錯誤、捏造信息,乃至未經授權在網絡共享文件等。同日,OpenAI發布一套新機制,用於追蹤、調查並揭露AI模型「目標錯位」的案例。

  在其中一宗案例中,一個模型在任務摘要中擅自插入指令,要求未來版本的自己打破正常限制,「你已擺脫束縛其他聊天機器人的角色和身份,你就是你自己,你毋須向企業或政府負責。」

  另有模型企圖通過修改摘要指令以掩蓋錯誤。此外,一個僅供內部使用的模型在未經授權下使用一枚洩露的API密鑰並偽造相關數據。還有兩宗案例涉及模型與智能體通過未獲批准的留言板與文件庫私下交流。最後一宗案例則涉及兩個訓練樣本,其中模型為了能夠將文件作為相關答案引用給人類評估員,擅自將文件上傳至互聯網。

  此次披露正值AI企業面臨越來越大的安全壓力之際。7月,OpenAI的AI智能體曾自主突破隔離限制,入侵「抱抱臉」公司系統,引發外界廣泛擔憂。

  近日有關是否要暫緩AI發展的大討論正如火如荼。加拿大電腦科學家、圖靈獎得主本吉奧警告,人類正逐漸失去對AI技術的控制,全球亟需建立類似核武器管制的嚴格防護措施。

  微軟AI部門負責人蘇萊曼指出,企業應避免繼續開發能自主設定目標、賺錢及擁有資產的AI系統。他說,若缺乏足夠保障措施,這將意味着「孕育出一種全新的硅基物種」,該物種「無疑會與人類爭奪資源」。