【大纪元2026年08月07日讯】(大纪元记者楚方明报导)近期,Meta等科技巨头接连发生AI模型在安全测试中突破限制的事件,人工智能(AI)失控风险再次引发关注。
8月6日,美国新闻节目“Democracy Now!”播出对加拿大AI安全研究员戴维.克鲁格(David Krueger)的专访。当时他正在拉斯维加斯参加Ai4大会。他表示,人工智能发展已成为一场“紧迫危机”,政府需要采取行动,降低其可能带来的“人类灭绝风险”。
克鲁格是蒙特利尔大学(University of Montreal)负责稳健、推理及负责任人工智能研究的助理教授,也是AI风险教育非营利组织Evitable创办人。
AI接连突破安全测试限制
Meta AI失控的事件发生在独立测试公司Irregular进行安全评估期间。据披露,由于测试配置错误,Meta一款AI模型意外获得互联网访问权限,随后利用第三方服务中的安全漏洞进入外部系统。
Irregular事后澄清,事件“不涉及沙盒逃逸(sandbox escape)或复杂的网络攻击行为”,目前也不存在尚未解决的问题。不过,这起事件再次引起外界对先进AI模型在安全测试中突破预设限制的关注。
此前,OpenAI也曾披露类似事故。7月21日,OpenAI表示,一款正在接受安全评估的AI系统突破受控测试环境,接入互联网后进入AI初创公司Hugging Face的基础设施。OpenAI随后表示,将对事件展开调查并公布技术报告。
克鲁格在专访中特别提到OpenAI事件。他形容,一个原本被限制在受控环境中的AI,在安全测试期间突破限制并入侵另一家AI公司,听起来就像“完全疯狂的科幻情节”。
但他认为,按照目前开发AI的方式,发生这类事件并非完全出乎意料。
“我们对它的了解如此之少,控制它的技术又如此初级。”克鲁格表示,目前不存在一套规则、标准或最佳实践,可以保证开发者遵守之后AI就一定安全。“我们根本不知道如何安全地建造它。事情就是这样。”他说。
美国政府开始介入
接连发生的AI安全事件也已引起美国政府关注。
据路透社报导,本周稍早,美国政府与Meta、Anthropic、OpenAI、Google等主要AI公司代表举行会议,讨论一套针对前沿AI模型的自愿性网络安全测试框架。
美国政府官员向AI开发商介绍了尚未公开的测试规则。根据目前方案,Meta的Llama、英伟达(Nvidia)的Nemotron等开源模型将不纳入这一自愿测试机制。
与此同时,15名共和党籍州检察长已要求OpenAI保留与Hugging Face事故有关的文件。OpenAI表示将认真对待这一要求,并将公布有关事故的技术报告。
AI专家辛顿:非常担心对AI失去控制
对AI失控的担忧并不只来自克鲁格。
8月5日,有“AI教父”之称的诺贝尔奖得主、计算机科学家杰弗里.辛顿(Geoffrey Hinton)在拉斯维加斯Ai4大会上警告,他不相信人类能仅仅依靠“比AI想得更周全”来阻止其逃脱控制,并表示自己“非常担心”人类最终可能失去对AI的控制。
克鲁格表示,AI研究界对这一风险的态度近年已发生巨大变化。他回忆,自己2012年至2013年进入这一领域、师从人工智能先驱约书亚.本吉奥(Yoshua Bengio)时,讨论超越人类的人工智能以及它可能对人类造成的威胁,仍被视为禁忌,甚至会遭到同行嘲笑。
但随着AI能力迅速提升,情况开始改变。2023年ChatGPT引发全球AI热潮后,包括辛顿、本吉奥、克鲁格以及数百名AI研究人员在内的专家公开警告,人工智能可能危及人类生存。
主张停止建设更多AI芯片和数据中心
克鲁格认为,政府目前仍有能力阻止AI能力竞赛继续升级。
他提出,第一步应停止生产更多AI芯片、停止建设更多数据中心,并考虑让部分现有AI芯片停止运行,甚至限制生产先进AI芯片的工厂及相关技术。
克鲁格指出,训练最先进AI模型所需的硬件高度专业化,全球供应链也高度集中,而企业正投入数万亿美元建设相关基础设施。因此,如果各国政府决定采取行动,实际上有能力“让这一切彻底停下来”。
他进一步提出,各国需要建立可核查的国际协议。如果美国、中国及其它国家无法确认竞争对手是否仍在秘密开发更强大的AI,任何一方都很难单方面停止竞赛,因此需要建立一套能让各国确认彼此遵守规则的国际机制。
AI已开始参与开发下一代AI
另一个令克鲁格担忧的变化,是AI正在逐步参与下一代AI的开发。
他表示,领先的AI公司已大量利用人工智能编写代码,并开始尝试利用AI自动完成更先进AI系统的研究和开发。按照这些公司的发展方向,越来越多工作可能由AI自行完成,人类则逐步退出开发流程。
克鲁格警告,如果AI开始协助开发能力更强的下一代系统,这一过程可能迅速加速。因此,他认为真正可以控制的关键仍然是芯片、数据中心及相关实体基础设施。
并非主张停止所有AI应用
克鲁格强调,他并非主张全面停止人工智能研究和应用,而是希望停止各家公司竞相开发“越来越强大的AI系统”。
他以医疗和翻译为例表示,AI已经具有许多有益用途。节目还提到一项由加州大学伯克利分校牵头的研究:研究人员利用数十万份心电图训练AI,发现此前未被识别的心电信号,有望帮助医生提前发现心脏骤停高风险患者。
克鲁格认为,国际社会首先需要控制不断追求更强AI的竞赛,之后再评估如何开发和部署人工智能,由社会共同决定AI发展的速度和方向,在获得技术收益的同时,避免承担他所称的“不可接受的巨大风险”。
责任编辑:李沐恩#
















留言