大紀元

報告:AI前沿公司均缺乏AI失控應對方案

報告:AI前沿公司均缺乏AI失控應對方案
圖為示意圖。(Shutterstock)
2026-08-2310:02 中港台時間|08-2310:30 更新
人氣 101

【大紀元2026年08月23日訊】(大紀元記者高杉編譯報導)一份最新分析報告顯示,在五家最頂尖的人工智能(AI)公司中,很少有實驗室公布或展示過針對AI失控情況的應對方案。

頂尖公司缺乏AI失控應急方案

據科技媒體TechCrunch週六(8月22日)報導,該分析報告來自致力於推廣前沿AI安全開發的組織Guidelight AI Standards。

該組織針對Anthropic、谷歌(Google)、OpenAI、Meta及xAI五家人工智能(AI)前沿公司的實驗室,在應對AI失控情境方面所做的準備工作進行了評級。其中,OpenAI的表現名列前茅;Anthropic和Meta的得分最低。

Guidelight主要評估了各家公司的公開文件,著重考察了在AI模型出現危險行為後,公司是否有明確的權限撤銷、活動監控、工作負載暫停,以及徹底關停等應對措施,同時也關注其內部日誌、違規行為追蹤,以及第三方安全審查等工作。

Guidelight首席科學家、OpenAI前安全研究員史蒂文·阿德勒(Steven Adler)對TechCrunch表示,令他意外的是,人工智能公司很少公開說明,一旦AI模型出現嚴重失控情況,公司究竟會如何處理。

他指出,隨著人工智能代理系統逐漸獲得更多自主權,公司應提前制定監管框架和監控模型行為,並在危險行動發生前進行干預。

OpenAI獲最高評分

在五家公司中,OpenAI表現最好,獲得5分中的3分。Guidelight指出,OpenAI過去曾在發現安全問題後,暫停或終止了部分工作負載,包括內部AI模型的部署和訓練,並明確說明了在恢復相關工作前需要採取的必要措施。

不過,Guidelight仍未能在OpenAI的公開資料中找到一套正式、完整的AI失控應急方案,用來規定未來何時及如何處置可能失去控制的AI模型。

OpenAI的一名發言人對此回應表示,公司內部已經制定了相關流程,可以限制AI模型的權限、暫停工作負載、縮小部署範圍,或將模型完全下線,並且過去已實際使用過這些措施。

Anthropic與Meta公開資訊較少

Guidelight解釋說,Anthropic和Meta在此次評估中得分最低的原因,主要是目前沒有找到足夠公開證據,證明兩家公司已有針對失控AI模型的具體遏制方案。

對此,Anthropic公司表示,如果發現模型試圖規避監管或擺脫及破壞人類的控制,公司會先進行風險評估,再決定是否採取遏制措施。

Meta則回應說,該公司已有AI風險評估框架。但Meta未說明是否存在未公開的內部應急計劃。

谷歌也就此分析報告表示,這項評估沒有涵蓋其全部AI安全與安保措施。

需預先制定AI失控應對方案

不過,Guidelight強調,低評分只反映了公開資訊不足,並不代表相關公司一定沒有內部安全措施。

阿德勒指出,人工智能發展速度很快,即使預先制定的方案未必能長期適用,提前進行風險規劃也仍然是十分重要的。

他表示,如果企業事先做好準備,面對真正的危機時也會更有能力應對。

責任編輯:孫芸#

如果您有新聞線索或資料給大紀元,請進入安全投稿爆料平台

留言

  • 大紀元保留刪除惡意留言的權利,包括低俗、誤導或攻擊信仰等內容
本網站圖文內容歸大紀元所有, 任何單位及個人未經許可,不得擅自轉載使用。
Copyright© 2000 - 2026 The Epoch TimesAssociation Inc.All Rights Reserved.