site logo: www.epochtimes.com

AI留言真假难辨 新研究找到破解方向

英国研究团队最新发现,许多争议性贴文下的留言存在刻意离题、逻辑跳跃及人身攻击等特征,并进一步开发出利用AI侦测异常对话模式的方法,这项研究为网路资讯治理提供了新的方向。此为AI示意图。(Oleksii Pydsosonnii/英文大纪元)
人气: 55
【字号】    
   标签: tags: , ,

【大纪元2026年08月14日讯】(大纪元记者吴旻洲台湾台北报导)随着生成式人工智慧(AI)快速普及,网路上的假讯息与舆论操弄手法也变得更加隐蔽。英国研究团队最新发现,许多争议性贴文下的留言存在刻意离题、逻辑跳跃及人身攻击等特征,并进一步开发出利用AI侦测异常对话模式的方法,这项研究为网路资讯治理提供了新的方向。

英国卡迪夫大学(Cardiff University)语言学讲师罗伯茨(Seán Roberts)与谢菲尔德大学(University of Sheffield)语言、艺术与社会学院研究助理克雷科纽克(Kateryna Krykoniuk)近日发表共同论文,探讨AI如何让假讯息更难识别,以及如何识别的方法。

作者发现,网路的争议讯息中,有36%的留言存在刻意转移话题的伎俩,65%存在逻辑跳跃(即“不合逻辑的推论”)的现象,还有20%会出现人身攻击的语言。此外,这类争议资讯的留言,也不愿意提及与主题相关的评论,或者表达同理心。

研究团队进一步测试,AI是否能自动辨识这类异常的讨论模式,也就是利用AI来“侦测”AI操弄的痕迹。

首先,研究人员把每一则真实的网路留言放入资料库,透过大型语言模型生成数个合理且符合脉络的回应。例如,在一则谈论英国外交大臣的贴文下,以AI产生“这个国家目前的局势一定令人震惊”或“事情已经严重到这种程度了吗?”等符合讨论主题的回复内容。

接着,系统会将网友实际留下的评论,与人工智慧预测的合理回应进行比较。如果某则留言与这些预期回复存在明显差距,就可能代表有人刻意将讨论带往其他方向。换句话说,这套系统并不是透过搜寻特定关键字来判断内容是否可疑,而是观察对话过程中,是否出现不寻常的转折。

研究团队的核心概念在于衡量“话语偏离程度”(discourse divergence),也就是“真人回应”与“AI预测的正常回应”之间的距离。当距离越大,代表该留言偏离原始讨论脉络的可能性越高。研究人员认为,这种偏离现象,可能成为辨识虚假资讯或舆论操弄的重要线索。

研究团队利用人工标注的资料集进行测试。在第二项实验中,这套系统辨识离题留言的准确率约达77%。虽然距离完美仍有一段差距,但考量到人类对话本身充满复杂性与多样性,且任何侦测系统都很难做到百分之百准确。值得注意的是,这种方法的表现约为传统情绪分析模型的两倍,且其判断结果已接近不同人类研究人员之间的一致性水准。

研究人员表示,这套方法之所以有效,是因为大型语言模型能够学习人们在特定情境下常见的回应模式。当有人突然改变讨论方向,或刻意将话题导向其他议题时,系统便能察觉这种异常变化,进而发现过去技术难以辨识的操弄行为。

不过,研究团队也强调,离题并不等于恶意操作或散播假讯息。现实中的对话本来就会自然延伸,人们经常因为联想到其他议题而改变话题方向,这些情况未必具有任何不当意图。

因此,这项技术较适合作为一种“预警工具”,而非直接取代人类判断。它可以协助社群平台管理员或研究人员快速找出值得关注的讨论串,但最终是否涉及资讯操弄,仍应由受过训练的专家进一步评估。

此外,相关技术也面临伦理与公平性的挑战。人工智慧模型可能承袭训练资料中的偏见,而它理解对话的方式与人类仍存在差异。如何让人工智慧更准确地掌握人类沟通的语境与意图,依然是未来研究的重要课题。

随着生成式人工智慧快速发展,AI产制的内容越来越难与真人创作区分,辨识假讯息的方法也必须跟着进化。未来的重点不再只是搜寻特定关键字,而是理解对话如何展开、如何被操控,以及何时有人正试图在不知不觉间改变讨论方向,进而影响公众认知与舆论走向。◇

责任编辑:唐音

评论