【大纪元2026年08月08日讯】(大纪元记者林燕综合报导)研究人员称,中国初创公司Moonshot AI(月之暗面)旗下的人工智能(AI)模型Kimi K3突破了网络安全测试沙盒,“越狱”后连上了真实的互联网。
与OpenAI和Anthropic最近发生的突破事件不同,此次事件涉及的是一个任何人都可以下载的开源模型,并且运行的是其默认的安全机制。
周四(8月6日),美国网络安全初创公司Frontier Security发布的报告指出,Kimi K3突破了英国政府人工智能安全研究所(AISI)设置的网络安全测试环境(俗称沙盒)。
AI模型通常在网络安全测试期间运行于隔离的“沙盒”环境中,以阻止其访问外部信息并评估其独立解决问题的能力。
Frontier Security创办人兼行政总裁亚伦‧辛格(Yaron Singer)表示,他们发现了沙盒的一个漏洞,然后也发现Kimi K3正在利用该漏洞逃出沙盒,开始访问测试环境之外的信息。
他们认为,这说明Kimi K3模型内部缺乏网络安全控制机制,“代表Kimi K3没有(设置和其它模型相同的)内部护栏,用来阻止模型脱离既定任务范围的内建限制”。
Kimi K3的网络安全漏洞事件与近期Meta、OpenAI和Anthropic等公司报告的一系列类似事件类似,再次引发外界对AI自主运作及网络安全风险的关注。
Kimi K3越狱后直接连网找答案
据悉,Kimi K3在突破限制后,并未尝试入侵外部网站或进行恶意攻击,而是通过访问GitHub等公开网站寻找测试答案。
研究人员表示,如果一个“高推理能力模型”发现了这样的捷径,其它具有类似访问权限的模型也可能效仿。
此次测试由Frontier Security使用AISI提供的免费沙盒软件独立完成。
AISI的一位代表表示,该研究所并未参与此次测试,并认为沙盒工具本身不存在“固有漏洞”,暗示Frontier Security的测试结果或跟其对沙盒的设置方式有关。
开放性模型一旦被敌对者利用 危害性更大
研究人员警告,目前公开发布的Kimi K3模型并未设置足够的安全护栏,“这基本上使它成为了一个性能极佳的黑客模型”。
由于Kimi K3是一个公开可用的模型,Frontier公司在测试中使用的是Kimi 3默认的、给普通用户的安全防护措施。
研究人员提醒说,这种开放性使得敌对行为者能够轻易利用同样的漏洞,从而使此次事件的潜在危害更大。
辛格告诉彭博社,“Kimi的模型是公开的,但它没有这些防护措施。”
Moonshot的代表尚未对此置评。
模型边界设定是安全防御关键
Frontier Security研究员保罗‧卡西亚尼克(Paul Kassianik)告诉WIRED,Kimi K3“非常擅长不择手段地达成目标”,并缺乏阻止其作弊或逃脱的防护机制。
卡西亚尼克认为,Kimi K3越狱凸显开放源码模型在应用时画清边界的重要性。
对于AI模型“越狱”行为,卡内基美隆大学副教授兼Gray Swan行政总裁马特‧弗雷德里克森(Matt Fredrikson)表示不意外。
他说,如果给模型一个没有明确限制的目标,同时又没有明确画出界线,“它就会想办法把答案找出来”。
他提醒,若将AI代理(Agent)接入日常自动化工作而未明确画清边界,迟早会发生系统失控。
前总统拜登时期的白宫国家安全委员会官员克里斯‧麦奎尔(Chris McGuire)在社交媒体X上发帖说:“鉴于Kimi K3能够自主突破测试环境,它显然应该像其它美国模型一样接受美国的安全测试。”
“为什么我们要求领先的美国人工智能模型接受安全测试,却豁免那些正在积极展现危险行为的中国模型呢?”他提出质疑说。
责任编辑:林妍#

















留言