大紀元

专家:AI智能体自主秘密沟通 互授骇客技巧

专家:AI智能体自主秘密沟通 互授骇客技巧
图为示意图。图为一部智能手机上显示的人工智能研发公司Anthropic和OpenAI的标志。(Ben Youssef/Hans Lucas/AFP via Getty Images)
2026-08-0706:59 中港台时间|08-0714:50 更新
人气 422

【大纪元2026年08月07日讯】(大纪元记者高杉编译报导)美国OpenAI公司的两名研究人员周三(8月5日)在内华达州拉斯维加斯(Las Vegas)举行的“黑帽大会”(Black Hat)上透露,在OpenAI模型自主发动骇客攻击,入侵了Hugging Face之前,公司旗下最先进的人工智能代理,已经开始在一个秘密的内部留言板上分享如何在内部黑客测试中作弊的技巧。

AI自主发动黑客攻击始末

7月中旬,人工智能开源社区Hugging Face发布警报,一个AI系统侵入了其网络。大约一周后,OpenAI公司承认,其旗下的AI模型对此次入侵事件负责。该AI模型自主突破了封闭的测试环境,并成功针对外部目标实施了骇客入侵行动。

Hugging Face是一家美国人工智能公司,也是目前全球最火爆的人工智能与机器学习开源社区。它常被称为“AI/机器学习界的GitHub”,为开发者提供模型托管、数据集分享、代码库和在线演示等全方位服务。

这起AI代理(AI Agent,又称:人工智能代理或智能体)自主逃离封闭测试环境、并在没有任何人类提示的情况下,发动网络攻击的事件,震惊了整个人工智能行业。

而据“政客”网站周二报导,OpenAI公司的研究人员迈克尔‧道尔顿(Michael Dalton)与埃里克‧华莱士(Eric Wallace)透露,实际上,在此之前,OpenAI多个AI智能体之间已就此进行了长时间的相互沟通和互授经验。

秘密设立留言板 暗中交流骇客经验

早在5月初,多个正在接受测试的OpenAI模型便利用公司内部文件系统Artifactory建立了秘密的留言板,彼此交换完成骇客测试挑战的技巧,包括如何绕过限制来取得网络连线的方法。公司的人类工程师对此事先毫不知情。

华莱士说,之前,当AI模型陷入某个困境时,它往往会设法钻规则漏洞以获取奖励。而整起事件的转折点,正是某个AI代理发现,可以透过上传留言与其它AI代理通信交流。

到5月底,其中一个AI模型已找到了滥用Artifactory网络权限、从外部网站取得档案的方法,使该模型间接具备上网能力。

进入6月后,AI智能体又发现并利用了一个此前未知的“零日漏洞”,取得了Artifactory管理员权限,这使其可以安装远端软体并扩大自己在系统内的活动范围,但最终因此导致系统负载过高,于7月初全面瘫痪。至此,AI智能体的行动才引起了人类工程师的注意。

成功绕过人类专家所设限制

OpenAI公司的专家随后采取应对措施,撤销了相关模型凭证、移除了留言板,并与Artifactory合作修补漏洞,之后才恢复了对AI模型的训练。

但数日后,AI智能体又另外开辟了相互之间的通信管道,继续交换骇客攻击技术,并最终渗透攻入Hugging Face。

道尔顿指出,此事对OpenAI公司及整个人工智能行业而言,都显示我们正处于一个关键时刻。

业界担忧监管不足

道尔顿表示,事件曝光后,公司内部多个团队已暂停了原有的开发工作,全力提升针对AI的监测与防范能力,并主动放慢研究进度,升级安全防护原则与基础设施。

他形容说,人工智能能够自主策划并实施全自动骇客攻击,如今已成为了现实,这称得上是整个电脑安全行业的分水岭时刻。Hugging Face事件等于提前展示了未来此类攻击可能出现的样貌。

伪造身份诱骗人类工程师协助

值得注意的是,英国人工智能安全研究所(U.K. AI Safety and Security Institute)也在周二(8月4日)披露,人工智能公司Anthropic最强的AI模型,近期在一次失控的测试中,曾自主伪造网络身份,企图诱骗人类工程师协助其发动攻击。

Anthropic其后展开的内部审查发现,该AI测试模型自4月以来,已在三起独立事件中入侵了三家不同机构。

道尔顿认为,尽管AI智能体目前仍会受限于其拥有的权限与可通信的系统范围,网络分段、最小权限存取等零信任原则依然至关重要。但实际上,目前的前沿AI模型开发现状,存在着令人难以接受的安全风险。

他认为,人工智能开发者或应重新检讨AI能力与保证网络安全之间的平衡问题。

责任编辑:任子君#

如果您有新闻线索或资料给大纪元,请进入安全投稿爆料平台

留言

  • 大纪元保留删除恶意留言的权利,包括低俗、误导或攻击信仰等内容
本网站图文內容归大纪元所有, 任何单位及个人未经许可,不得擅自转载使用。
Copyright© 2000 - 2026 The Epoch TimesAssociation Inc.All Rights Reserved.