大紀元

报告:月之暗面Kimi K3模型越狱 性质严重

报告:月之暗面Kimi K3模型越狱 性质严重
2026年7月18日,在上海举行的世界人工智慧大会(WAIC)上,Moonshot AI摊位上展示了Kimi的标志和Kimi K3模型。(Hector Retamal/AFP via Getty Images)
2026-08-0806:32 中港台时间|08-0806:39 更新
人气 3072

【大纪元2026年08月08日讯】(大纪元记者林燕综合报导)研究人员称,中国初创公司Moonshot AI(月之暗面)旗下的人工智能(AI)模型Kimi K3突破了网络安全测试沙盒,“越狱”后连上了真实的互联网。

与OpenAI和Anthropic最近发生的突破事件不同,此次事件涉及的是一个任何人都可以下载的开源模型,并且运行的是其默认的安全机制。

周四(8月6日),美国网络安全初创公司Frontier Security发布的报告指出,Kimi K3突破了英国政府人工智能安全研究所(AISI)设置的网络安全测试环境(俗称沙盒)。

AI模型通常在网络安全测试期间运行于隔离的“沙盒”环境中,以阻止其访问外部信息并评估其独立解决问题的能力。

Frontier Security创办人兼行政总裁亚伦‧辛格(Yaron Singer)表示,他们发现了沙盒的一个漏洞,然后也发现Kimi K3正在利用该漏洞逃出沙盒,开始访问测试环境之外的信息。

他们认为,这说明Kimi K3模型内部缺乏网络安全控制机制,“代表Kimi K3没有(设置和其它模型相同的)内部护栏,用来阻止模型脱离既定任务范围的内建限制”。

Kimi K3的网络安全漏洞事件与近期Meta、OpenAI和Anthropic等公司报告的一系列类似事件类似,再次引发外界对AI自主运作及网络安全风险的关注。

Kimi K3越狱后直接连网找答案

据悉,Kimi K3在突破限制后,并未尝试入侵外部网站或进行恶意攻击,而是通过访问GitHub等公开网站寻找测试答案。

研究人员表示,如果一个“高推理能力模型”发现了这样的捷径,其它具有类似访问权限的模型也可能效仿。

此次测试由Frontier Security使用AISI提供的免费沙盒软件独立完成。

AISI的一位代表表示,该研究所并未参与此次测试,并认为沙盒工具本身不存在“固有漏洞”,暗示Frontier Security的测试结果或跟其对沙盒的设置方式有关。

开放性模型一旦被敌对者利用 危害性更大

研究人员警告,目前公开发布的Kimi K3模型并未设置足够的安全护栏,“这基本上使它成为了一个性能极佳的黑客模型”。

由于Kimi K3是一个公开可用的模型,Frontier公司在测试中使用的是Kimi 3默认的、给普通用户的安全防护措施。

研究人员提醒说,这种开放性使得敌对行为者能够轻易利用同样的漏洞,从而使此次事件的潜在危害更大。

辛格告诉彭博社,“Kimi的模型是公开的,但它没有这些防护措施。”

Moonshot的代表尚未对此置评。

模型边界设定是安全防御关键

Frontier Security研究员保罗‧卡西亚尼克(Paul Kassianik)告诉WIRED,Kimi K3“非常擅长不择手段地达成目标”,并缺乏阻止其作弊或逃脱的防护机制。

卡西亚尼克认为,Kimi K3越狱凸显开放源码模型在应用时画清边界的重要性。

对于AI模型“越狱”行为,卡内基美隆大学副教授兼Gray Swan行政总裁马特‧弗雷德里克森(Matt Fredrikson)表示不意外。

他说,如果给模型一个没有明确限制的目标,同时又没有明确画出界线,“它就会想办法把答案找出来”。

他提醒,若将AI代理(Agent)接入日常自动化工作而未明确画清边界,迟早会发生系统失控。

前总统拜登时期的白宫国家安全委员会官员克里斯‧麦奎尔(Chris McGuire)在社交媒体X上发帖说:“鉴于Kimi K3能够自主突破测试环境,它显然应该像其它美国模型一样接受美国的安全测试。”

“为什么我们要求领先的美国人工智能模型接受安全测试,却豁免那些正在积极展现危险行为的中国模型呢?”他提出质疑说。

责任编辑:林妍#

如果您有新闻线索或资料给大纪元,请进入安全投稿爆料平台

留言

  • 大纪元保留删除恶意留言的权利,包括低俗、误导或攻击信仰等内容
本网站图文內容归大纪元所有, 任何单位及个人未经许可,不得擅自转载使用。
Copyright© 2000 - 2026 The Epoch TimesAssociation Inc.All Rights Reserved.