大紀元

專家:AI智能體自主祕密溝通 互授駭客技巧

專家:AI智能體自主祕密溝通 互授駭客技巧
圖為示意圖。圖為一部智能手機上顯示的人工智能研發公司Anthropic和OpenAI的標誌。(Ben Youssef/Hans Lucas/AFP via Getty Images)
2026-08-0706:59 中港台時間|08-0707:19 更新
人氣 1

【大紀元2026年08月07日訊】(大紀元記者高杉編譯報導)美國OpenAI公司的兩名研究人員週三(8月5日)在內華達州拉斯維加斯(Las Vegas)舉行的「黑帽大會」(Black Hat)上透露,在OpenAI模型自主發動駭客攻擊,入侵了Hugging Face之前,公司旗下最先進的人工智能代理,已經開始在一個祕密的內部留言板上分享如何在內部黑客測試中作弊的技巧。

AI自主發動黑客攻擊始末

7月中旬,人工智能開源社區Hugging Face發布警報,一個AI系統侵入了其網絡。大約一週後,OpenAI公司承認,其旗下的AI模型對此次入侵事件負責。該AI模型自主突破了封閉的測試環境,並成功針對外部目標實施了駭客入侵行動。

Hugging Face是一家美國人工智能公司,也是目前全球最火爆的人工智能與機器學習開源社區。它常被稱為「AI/機器學習界的GitHub」,為開發者提供模型託管、數據集分享、代碼庫和在線演示等全方位服務。

這起AI代理(AI Agent,又稱:人工智能代理或智能體)自主逃離封閉測試環境、並在沒有任何人類提示的情況下,發動網絡攻擊的事件,震驚了整個人工智能行業。

而據「政客」網站週二報導,OpenAI公司的研究人員邁克爾‧道爾頓(Michael Dalton)與埃里克‧華萊士(Eric Wallace)透露,實際上,在此之前,OpenAI多個AI智能體之間已就此進行了長時間的相互溝通和互授經驗。

祕密設立留言板 暗中交流駭客經驗

早在5月初,多個正在接受測試的OpenAI模型便利用公司內部文件系統Artifactory建立了祕密的留言板,彼此交換完成駭客測試挑戰的技巧,包括如何繞過限制來取得網絡連線的方法。公司的人類工程師對此事先毫不知情。

華萊士說,之前,當AI模型陷入某個困境時,它往往會設法鑽規則漏洞以獲取獎勵。而整起事件的轉折點,正是某個AI代理發現,可以透過上傳留言與其它AI代理通信交流。

到5月底,其中一個AI模型已找到了濫用Artifactory網絡權限、從外部網站取得檔案的方法,使該模型間接具備上網能力。

進入6月後,AI智能體又發現並利用了一個此前未知的「零日漏洞」,取得了Artifactory管理員權限,這使其可以安裝遠端軟體並擴大自己在系統內的活動範圍,但最終因此導致系統負載過高,於7月初全面癱瘓。至此,AI智能體的行動才引起了人類工程師的注意。

成功繞過人類專家所設限制

OpenAI公司的專家隨後採取應對措施,撤銷了相關模型憑證、移除了留言板,並與Artifactory合作修補漏洞,之後才恢復了對AI模型的訓練。

但數日後,AI智能體又另外開闢了相互之間的通信管道,繼續交換駭客攻擊技術,並最終滲透攻入Hugging Face。

道爾頓指出,此事對OpenAI公司及整個人工智能行業而言,都顯示我們正處於一個關鍵時刻。

業界擔憂監管不足

道爾頓表示,事件曝光後,公司內部多個團隊已暫停了原有的開發工作,全力提升針對AI的監測與防範能力,並主動放慢研究進度,升級安全防護原則與基礎設施。

他形容說,人工智能能夠自主策劃並實施全自動駭客攻擊,如今已成為了現實,這稱得上是整個電腦安全行業的分水嶺時刻。Hugging Face事件等於提前展示了未來此類攻擊可能出現的樣貌。

僞造身分誘騙人類工程師協助

值得注意的是,英國人工智能安全研究所(U.K. AI Safety and Security Institute)也在週二(8月4日)披露,人工智能公司Anthropic最強的AI模型,近期在一次失控的測試中,曾自主偽造網絡身分,企圖誘騙人類工程師協助其發動攻擊。

Anthropic其後展開的內部審查發現,該AI測試模型自4月以來,已在三起獨立事件中入侵了三家不同機構。

道爾頓認為,儘管AI智能體目前仍會受限於其擁有的權限與可通信的系統範圍,網絡分段、最小權限存取等零信任原則依然至關重要。但實際上,目前的前沿AI模型開發現狀,存在著令人難以接受的安全風險。

他認為,人工智能開發者或應重新檢討AI能力與保證網絡安全之間的平衡問題。

責任編輯:任子君#

如果您有新聞線索或資料給大紀元,請進入安全投稿爆料平台

留言

  • 大紀元保留刪除惡意留言的權利,包括低俗、誤導或攻擊信仰等內容
本網站圖文內容歸大紀元所有, 任何單位及個人未經許可,不得擅自轉載使用。
Copyright© 2000 - 2026 The Epoch TimesAssociation Inc.All Rights Reserved.