恒大研AI大型语言模型识别网络欺凌

2026-10-07 05:15:09 大公报
字号
放大
标准
分享

【大公报讯】记者郭如佳报道:香港恒生大学一项最新研究,利用具私隐保护的数据及大型语言模型(LLM),从更广泛对话语境理解网络欺凌行为,为建立更安全数码社群提供新方向。研究由恒大计算机科学系助理教授朱振辉领导,两项相关研究已于2026年发表,分别刊于学术期刊《Data》及《Intelligent Systems with Applications》。

朱振辉指出,项目数年前开展时,技术尚未能分析涉及多名参与者的复杂网上对话,LLM最新进展令工作变为可能。他续指,本港网上沟通常混合广东话、书面中文、英文及本地网络潮语,传统AI难以处理这类语码混合语言;网络欺凌亦可能以讽刺、嘲笑或间接攻击出现,未必用明显冒犯字眼。

团队开发「具私隐保护的中英夹杂网络欺凌数据集」,从社交平台X(前称Twitter)搜集14000多条经人工标注帖文,分为1600多段对话,耗时逾六个月搜集、清理及标注。

研究并非只评估个别帖文,而是分析多名参与者及多轮交流的完整对话。LLM框架可识别受害者、施暴者及欺凌互动行为,并考虑行为如何随时间演变,以辨识重复针对、间接提及和不断变化的人际关系。研究亦提出更有系统方式评估严重程度,考虑欺凌互动频率、施暴者人数及权力失衡,有助优先处理高风险个案,及早人为介入。