恒大研新AI框架識別網絡欺凌
網絡欺凌往往隱藏於中英夾雜、與潮語混雜的對話之中,傳統人工智能(AI)系統難以識別。香港恒生大學計算機科學系助理教授朱振輝領導團隊,利用具私隱保護的數據及大型語言模型(LLM),從更廣泛的對話語境理解網絡欺凌行為,成功開發出能在欺凌逐漸形成時及早識別的框架,為建立更安全數碼社群提供新方向。
團隊開發了「具私隱保護的中英夾雜網絡欺凌數據集」,包含從社交平台X(前稱Twitter)蒐集1.4萬多條經人工標註的帖文,分為1,600多段對話。研究人員分析涉及多名參與者及多輪交流的完整對話,由LLM驅動識別出受害者、施暴者及欺凌互動行為,同時考慮相關行為如何隨時間演變,系統能辨識重複針對、間接提及和不斷變化的人際關係。團隊計劃之後把研究由文字擴展至圖像、迷因(meme)及其他多模態內容。