大紀元

報告:月之暗面Kimi K3模型越獄 性質嚴重

報告:月之暗面Kimi K3模型越獄 性質嚴重
2026年7月18日,在上海舉行的世界人工智慧大會(WAIC)上,Moonshot AI攤位上展示了Kimi的標誌和Kimi K3模型。(Hector Retamal/AFP via Getty Images)
2026-08-0806:32 中港台時間|08-0806:39 更新
人氣 65

【大紀元2026年08月08日訊】(大紀元記者林燕綜合報導)研究人員稱,中國初創公司Moonshot AI(月之暗面)旗下的人工智能(AI)模型Kimi K3突破了網絡安全測試沙盒,「越獄」後連上了真實的互聯網。

與OpenAI和Anthropic最近發生的突破事件不同,此次事件涉及的是一個任何人都可以下載的開源模型,並且運行的是其默認的安全機制。

週四(8月6日),美國網絡安全初創公司Frontier Security發布的報告指出,Kimi K3突破了英國政府人工智能安全研究所(AISI)設置的網絡安全測試環境(俗稱沙盒)。

AI模型通常在網絡安全測試期間運行於隔離的「沙盒」環境中,以阻止其訪問外部信息並評估其獨立解決問題的能力。

Frontier Security創辦人兼行政總裁亞倫‧辛格(Yaron Singer)表示,他們發現了沙盒的一個漏洞,然後也發現Kimi K3正在利用該漏洞逃出沙盒,開始訪問測試環境之外的信息。

他們認為,這說明Kimi K3模型內部缺乏網絡安全控制機制,「代表Kimi K3沒有(設置和其它模型相同的)內部護欄,用來阻止模型脫離既定任務範圍的內建限制」。

Kimi K3的網絡安全漏洞事件與近期Meta、OpenAI和Anthropic等公司報告的一系列類似事件類似,再次引發外界對AI自主運作及網絡安全風險的關注。

Kimi K3越獄後直接連網找答案

據悉,Kimi K3在突破限制後,並未嘗試入侵外部網站或進行惡意攻擊,而是通過訪問GitHub等公開網站尋找測試答案。

研究人員表示,如果一個「高推理能力模型」發現了這樣的捷徑,其它具有類似訪問權限的模型也可能效仿。

此次測試由Frontier Security使用AISI提供的免費沙盒軟件獨立完成。

AISI的一位代表表示,該研究所並未參與此次測試,並認為沙盒工具本身不存在「固有漏洞」,暗示Frontier Security的測試結果或跟其對沙盒的設置方式有關。

開放性模型一旦被敵對者利用 危害性更大

研究人員警告,目前公開發布的Kimi K3模型並未設置足夠的安全護欄,「這基本上使它成為了一個性能極佳的黑客模型」。

由於Kimi K3是一個公開可用的模型,Frontier公司在測試中使用的是Kimi 3默認的、給普通用戶的安全防護措施。

研究人員提醒說,這種開放性使得敵對行為者能夠輕易利用同樣的漏洞,從而使此次事件的潛在危害更大。

辛格告訴彭博社,「Kimi的模型是公開的,但它沒有這些防護措施。」

Moonshot的代表尚未對此置評。

模型邊界設定是安全防禦關鍵

Frontier Security研究員保羅‧卡西亞尼克(Paul Kassianik)告訴WIRED,Kimi K3「非常擅長不擇手段地達成目標」,並缺乏阻止其作弊或逃脫的防護機制。

卡西亞尼克認為,Kimi K3越獄凸顯開放源碼模型在應用時畫清邊界的重要性。

對於AI模型「越獄」行為,卡內基美隆大學副教授兼Gray Swan行政總裁馬特‧弗雷德里克森(Matt Fredrikson)表示不意外。

他說,如果給模型一個沒有明確限制的目標,同時又沒有明確畫出界線,「它就會想辦法把答案找出來」。

他提醒,若將AI代理(Agent)接入日常自動化工作而未明確畫清邊界,遲早會發生系統失控。

前總統拜登時期的白宮國家安全委員會官員克里斯‧麥奎爾(Chris McGuire)在社交媒體X上發帖說:「鑒於Kimi K3能夠自主突破測試環境,它顯然應該像其它美國模型一樣接受美國的安全測試。」

「為什麼我們要求領先的美國人工智能模型接受安全測試,卻豁免那些正在積極展現危險行為的中國模型呢?」他提出質疑說。

責任編輯:林姸#

如果您有新聞線索或資料給大紀元,請進入安全投稿爆料平台

留言

  • 大紀元保留刪除惡意留言的權利,包括低俗、誤導或攻擊信仰等內容
本網站圖文內容歸大紀元所有, 任何單位及個人未經許可,不得擅自轉載使用。
Copyright© 2000 - 2026 The Epoch TimesAssociation Inc.All Rights Reserved.