恒大研AI大型語言模型識別網絡欺凌
【大公報訊】記者郭如佳報道:香港恒生大學一項最新研究,利用具私隱保護的數據及大型語言模型(LLM),從更廣泛對話語境理解網絡欺凌行為,為建立更安全數碼社群提供新方向。研究由恒大計算機科學系助理教授朱振輝領導,兩項相關研究已於2026年發表,分別刊於學術期刊《Data》及《Intelligent Systems with Applications》。
朱振輝指出,項目數年前開展時,技術尚未能分析涉及多名參與者的複雜網上對話,LLM最新進展令工作變為可能。他續指,本港網上溝通常混合廣東話、書面中文、英文及本地網絡潮語,傳統AI難以處理這類語碼混合語言;網絡欺凌亦可能以諷刺、嘲笑或間接攻擊出現,未必用明顯冒犯字眼。
團隊開發「具私隱保護的中英夾雜網絡欺凌數據集」,從社交平台X(前稱Twitter)蒐集14000多條經人工標註帖文,分為1600多段對話,耗時逾六個月蒐集、清理及標註。
研究並非只評估個別帖文,而是分析多名參與者及多輪交流的完整對話。LLM框架可識別受害者、施暴者及欺凌互動行為,並考慮行為如何隨時間演變,以辨識重複針對、間接提及和不斷變化的人際關係。研究亦提出更有系統方式評估嚴重程度,考慮欺凌互動頻率、施暴者人數及權力失衡,有助優先處理高風險個案,及早人為介入。