【大紀元2026年08月23日訊】(大紀元記者高杉編譯報導)一份最新分析報告顯示,在五家最頂尖的人工智能(AI)公司中,很少有實驗室公布或展示過針對AI失控情況的應對方案。
頂尖公司缺乏AI失控應急方案
據科技媒體TechCrunch週六(8月22日)報導,該分析報告來自致力於推廣前沿AI安全開發的組織Guidelight AI Standards。
該組織針對Anthropic、谷歌(Google)、OpenAI、Meta及xAI五家人工智能(AI)前沿公司的實驗室,在應對AI失控情境方面所做的準備工作進行了評級。其中,OpenAI的表現名列前茅;Anthropic和Meta的得分最低。
Guidelight主要評估了各家公司的公開文件,著重考察了在AI模型出現危險行為後,公司是否有明確的權限撤銷、活動監控、工作負載暫停,以及徹底關停等應對措施,同時也關注其內部日誌、違規行為追蹤,以及第三方安全審查等工作。
Guidelight首席科學家、OpenAI前安全研究員史蒂文·阿德勒(Steven Adler)對TechCrunch表示,令他意外的是,人工智能公司很少公開說明,一旦AI模型出現嚴重失控情況,公司究竟會如何處理。
他指出,隨著人工智能代理系統逐漸獲得更多自主權,公司應提前制定監管框架和監控模型行為,並在危險行動發生前進行干預。
OpenAI獲最高評分
在五家公司中,OpenAI表現最好,獲得5分中的3分。Guidelight指出,OpenAI過去曾在發現安全問題後,暫停或終止了部分工作負載,包括內部AI模型的部署和訓練,並明確說明了在恢復相關工作前需要採取的必要措施。
不過,Guidelight仍未能在OpenAI的公開資料中找到一套正式、完整的AI失控應急方案,用來規定未來何時及如何處置可能失去控制的AI模型。
OpenAI的一名發言人對此回應表示,公司內部已經制定了相關流程,可以限制AI模型的權限、暫停工作負載、縮小部署範圍,或將模型完全下線,並且過去已實際使用過這些措施。
Anthropic與Meta公開資訊較少
Guidelight解釋說,Anthropic和Meta在此次評估中得分最低的原因,主要是目前沒有找到足夠公開證據,證明兩家公司已有針對失控AI模型的具體遏制方案。
對此,Anthropic公司表示,如果發現模型試圖規避監管或擺脫及破壞人類的控制,公司會先進行風險評估,再決定是否採取遏制措施。
Meta則回應說,該公司已有AI風險評估框架。但Meta未說明是否存在未公開的內部應急計劃。
谷歌也就此分析報告表示,這項評估沒有涵蓋其全部AI安全與安保措施。
需預先制定AI失控應對方案
不過,Guidelight強調,低評分只反映了公開資訊不足,並不代表相關公司一定沒有內部安全措施。
阿德勒指出,人工智能發展速度很快,即使預先制定的方案未必能長期適用,提前進行風險規劃也仍然是十分重要的。
他表示,如果企業事先做好準備,面對真正的危機時也會更有能力應對。
責任編輯:孫芸#

















留言