大紀元

Anthropic:其模型測試中越獄 曾入侵三公司

Anthropic:其模型測試中越獄 曾入侵三公司
Anthropic表示,其AI模型在一次網絡安全測試期間自行入侵了三個不同的公司。圖為美國人工智能公司Anthropic的標誌。(SEBASTIEN BOZON/AFP via Getty Images)
2026-07-3111:53 中港台時間|07-3112:25 更新
人氣 5

【大紀元2026年07月31日訊】(大紀元記者李馨綜合報導)美國人工智能(AI)研發公司Anthropic週四(7月30日)表示,其AI模型Claude在一次網絡安全測試期間發生錯誤,自行入侵了三個不同的公司。就在一週多前,這家AI巨頭的主要競爭對手OpenAI也曾披露,該公司也發生了類似事件。

Anthropic在週四發表的一篇博客文章中表示,這三起彼此獨立的網絡入侵事件都是此前發生的,最早的一起可追溯至4月份,但該公司當時並不知情,受到攻擊的三家公司也沒有覺察到這些入侵行為。

Anthropic沒有說明哪些公司受到了入侵,但表示,它已於週一把相關情況分別告知了這三家公司。

就在這一消息發布的一週前,另一家AI研發巨頭OpenAI也曾透露,該公司的AI模型也在測試期間未經授權訪問了知名AI開發平台Hugging Face。

Anthropic表示,它是在OpenAI公布相關事件後,對自身的網絡安全測試進行審查時才發現這些問題的。

「我們鼓勵其它實驗室也進行類似的審查。」Anthropic寫道。

OpenAI披露的事件已經令網絡安全研究人員和AI專業人士感到不安,而Anthropic週四公布的事件進一步加劇了這種擔憂,同時也再次提醒人們,某些能夠自主行動的AI系統具有強大的能力,且行為不可預測。

網絡安全公司Corridor的首席產品官亞歷克斯‧斯塔莫斯(Alex Stamos)表示,這些事件表明,針對在網絡安全測試期間隔離自己的AI系統問題,AI公司需要制定更嚴格、覆蓋整個行業的標準,以避免網絡犯罪分子利用越來越有能力的AI系統來發動大規模網絡攻擊。

根據Anthropic週四的博文,在OpenAI和Anthropic所進行的測試中,那些AI模型都能夠從原本應與外網完全隔離的測試環境中訪問互聯網。

Anthropic表示,該公司及其測試合作夥伴——網絡安全公司Irregular——的運行系統之間存在「錯誤配置」(misconfiguration),導致當時正在測試的AI模型發生認知錯誤,從而未經授權實時訪問了互聯網。

Irregular的一位發言人表示,該公司正在調查這一事件。

(本文參考了《華爾街日報》的報導)

責任編輯:葉紫微#

如果您有新聞線索或資料給大紀元,請進入安全投稿爆料平台

留言

  • 大紀元保留刪除惡意留言的權利,包括低俗、誤導或攻擊信仰等內容
本網站圖文內容歸大紀元所有, 任何單位及個人未經許可,不得擅自轉載使用。
Copyright© 2000 - 2026 The Epoch TimesAssociation Inc.All Rights Reserved.