【大纪元2026年08月23日讯】(大纪元记者高杉编译报导)一份最新分析报告显示,在五家最顶尖的人工智能(AI)公司中,很少有实验室公布或展示过针对AI失控情况的应对方案。
顶尖公司缺乏AI失控应急方案
据科技媒体TechCrunch周六(8月22日)报导,该分析报告来自致力于推广前沿AI安全开发的组织Guidelight AI Standards。
该组织针对Anthropic、谷歌(Google)、OpenAI、Meta及xAI五家人工智能(AI)前沿公司的实验室,在应对AI失控情境方面所做的准备工作进行了评级。其中,OpenAI的表现名列前茅;Anthropic和Meta的得分最低。
Guidelight主要评估了各家公司的公开文件,着重考察了在AI模型出现危险行为后,公司是否有明确的权限撤销、活动监控、工作负载暂停,以及彻底关停等应对措施,同时也关注其内部日志、违规行为追踪,以及第三方安全审查等工作。
Guidelight首席科学家、OpenAI前安全研究员史蒂文·阿德勒(Steven Adler)对TechCrunch表示,令他意外的是,人工智能公司很少公开说明,一旦AI模型出现严重失控情况,公司究竟会如何处理。
他指出,随着人工智能代理系统逐渐获得更多自主权,公司应提前制定监管框架和监控模型行为,并在危险行动发生前进行干预。
OpenAI获最高评分
在五家公司中,OpenAI表现最好,获得5分中的3分。Guidelight指出,OpenAI过去曾在发现安全问题后,暂停或终止了部分工作负载,包括内部AI模型的部署和训练,并明确说明了在恢复相关工作前需要采取的必要措施。
不过,Guidelight仍未能在OpenAI的公开资料中找到一套正式、完整的AI失控应急方案,用来规定未来何时及如何处置可能失去控制的AI模型。
OpenAI的一名发言人对此回应表示,公司内部已经制定了相关流程,可以限制AI模型的权限、暂停工作负载、缩小部署范围,或将模型完全下线,并且过去已实际使用过这些措施。
Anthropic与Meta公开资讯较少
Guidelight解释说,Anthropic和Meta在此次评估中得分最低的原因,主要是目前没有找到足够公开证据,证明两家公司已有针对失控AI模型的具体遏制方案。
对此,Anthropic公司表示,如果发现模型试图规避监管或摆脱及破坏人类的控制,公司会先进行风险评估,再决定是否采取遏制措施。
Meta则回应说,该公司已有AI风险评估框架。但Meta未说明是否存在未公开的内部应急计划。
谷歌也就此分析报告表示,这项评估没有涵盖其全部AI安全与安保措施。
需预先制定AI失控应对方案
不过,Guidelight强调,低评分只反映了公开资讯不足,并不代表相关公司一定没有内部安全措施。
阿德勒指出,人工智能发展速度很快,即使预先制定的方案未必能长期适用,提前进行风险规划也仍然是十分重要的。
他表示,如果企业事先做好准备,面对真正的危机时也会更有能力应对。
责任编辑:孙芸#

















留言