大紀元

【名家专栏】需要管控中共人工智能模型

【名家专栏】需要管控中共人工智能模型
2024年2月26日,在西班牙巴塞罗那举行的世界移动通信大会(Mobile World Congress,简称MWC,全球电信行业年度最大盛会)上,一位参观者正在查看手机旁边的OpenAI标志。(Pau Barrena/AFP via Getty Images)
2026-08-0507:42 中港台时间|08-0610:56 更新
人气 192

【大纪元2026年08月01日讯】(英文大纪元专栏作家Anders Corr撰文/信宇编译)在最近一次对两款OpenAI模型的测试中,它们突破了本应与互联网隔离的“沙盒”(Sandbox)环境,并入侵了另一家美国公司“抱抱脸”(Hugging Face,总部位于纽约)。OpenAI将这起由人工智能(AI)自主发动的攻击称为“前所未有”(Unprecedented)。

遭到入侵的抱抱脸公司是一家提供开源AI工具的公司。这两款OpenAI模型,包括GPT‑5.6 Sol,以及另一款尚未发布、能力更强的模型(除了曾短暂发布过一次之外),认为入侵抱抱脸公司能够帮助它们在OpenAI的评估测试中作弊。

该事件凸显了AI模型失控的风险,它们可能自行行动,而不是听命于人类管理者,闯入互联网的蛮荒之地,甚至造成持续性的危害。

抱抱脸公司(Hugging Face)最初向安特罗匹克公司(Anthropic,总部位于加州旧金山)的Fable模型请求帮助,希望它协助抵御这次攻击。但是后者拒绝了前者的网络安全协助要求,理由是担心攻击者可能伪装成防御方提出请求。即使是最先进的AI模型,也并非总能区分攻击者(Attacker)和防御方(Defender)。Fable的安全防护机制随即启动,依照其一般规则,除了少数大型企业与政府机构外,该机制通常都会拒绝处理网络安全相关请求。

随后,抱抱脸公司转而使用智谱公司(Z.ai,总部位于北京)的GLM 5.2,这是一款中国开发的、相较之下设有较少的安全防护措施的模型。抱抱脸公司声称,GLM 5.2使用起来更简单、更快速、更经济、更安全。攻击者的数据(例如恶意程式码、攻击样本、测试案例等)和防御方的凭证(如API金钥、账号密码、存取权等敏感资讯)均未离开抱抱脸公司的计算环境,没有传送到外部公司的云端或服务器。

抱抱脸公司对这款中国模型的赞扬,想必对中共政权来说,正合其心意。

GLM 5.2使用开放权重(open weights)模式。开放权重模型可供使用者下载,并依照自身需求修改。这意味着,当美国三大科技公司——安特罗匹克(Anthropic)、OpenAI和谷歌(Google)——的安全防护机制(Guardrails)起到阻碍时,这类模型可能对防御方有用。

然而,一旦开放权重模型被下载,开发该模型的公司就对其失去了控制权,这增加了威权政权、黑客或恐怖分子滥用它从事恶意行为的风险。智谱公司之所以能在抱抱脸公司黑客事件中派上用场,正是因为它缺乏同样的安全防护措施;而同样的特性,也可能使智谱公司模型成为恶意行为者的工具。

因此,解决之道未必是像抱抱脸公司所推崇的那样,采用开放权重或取消安全防护机制,而是在合乎道德的私人AI系统中建立更好的安全防护机制,从而使这些系统完全无法被用于恶意目的。

中国公司生产的AI模型最终都受中共政权的控制,中共可能会试图在这些模型中植入亲中共的偏见,或者插入后门程式,使中共政权能够入侵模型用户的系统。

中国的AI模型有时会通过“蒸馏”(Distillation)方式窃取美国模型的成果。“蒸馏”是指让功能较弱的模型,以功能较强的原始模型(例如安特罗匹克、OpenAI与谷歌等美国公司推出的模型)所产生的资料进行训练。这种做法涉及窃取知识产权,而这些源自窃取的成果,也更可能被用于恶意用途。

白宫声称,有信息表明,中国AI新创公司“月之暗面”(Moonshot AI,总部位于北京)通过对安特罗匹克公司Fable人工智能模型进行“蒸馏”,开发出了其功能强大的Kimi K3模型,并且很可能透过泰国取得了(英伟达公司的)GB300芯片进行训练,这违反了美国的出口管制规定。安特罗匹克公司回应称,大规模进行模型“蒸馏”已对美国及其民主盟友的国家安全构成威胁。

安特罗匹克(Anthropic,总部位于加州旧金山)是一家成立于2021年的美国人工智能公司。(Riccardo Milani/Hans Lucas via AFP via Getty Images)
安特罗匹克(Anthropic,总部位于加州旧金山)是一家成立于2021年的美国人工智能公司。(Riccardo Milani/Hans Lucas via AFP via Getty Images)

虽然美国的AI模型整体而言在该领域居于领先地位,但是中国在免费开放权重模型方面占有优势,这使得中国模型在全球应用和用户数量方面更具竞争力。这种优势可以说是通过模型“蒸馏”窃取美国技术而不公平取得的。

美国正在考虑对涉及这类盗窃行为的责任人或机构实施制裁。美国财政部长斯科特贝森特(Scott Bessent)在X社交平台上发文表示:“当(中国)公司进行秘密的、大规模的模型蒸馏攻击,并越过界限构成知识产权盗窃时,美国将考虑祭出制裁,并将相关企业列入‘实体清单’(Entity List)。”

由于中国的开放权重模型的安全防护机制较少,且目前受到中共的控制,因此其造成危害的风险尤其高。中共具有极权、种族灭绝与霸权扩张等目标,而在中共掌控下发展与运用的AI技术,可能会助长这些目标的实现。

中国的AI模型可能会宣传中共的一些危险的威权主义政策,也可能透过入侵毫无戒心的受害者的电脑网络、自行植入黑客内容,而导致失控。

面对中国的开放权重模型可能失控,或被用于威权统治、黑客攻击及恐怖活动的风险,解决之道并非接受缺乏安全防护机制的高风险开放权重模型。相反,全世界需要建立更完善的安全防护机制,使其能够区分合法防御方与攻击者,并对恶意行为者滥用开放权重模型采取更强硬的管理措施。

开放权重模型落入恶意行为者手中的威胁已近在眼前,因此世界各国必须尽快采取行动。一旦恐怖分子、独裁者或黑客将开放权重模型下载到自己的服务器上,情势可能就难以挽回了。他们中有人可能打造出一种仇视人类(Misanthropic)的AI技术,使其像病毒一样在防护不足的服务器上自我复制,其目的不是帮助人类,而是摧毁人类。

作者简介:

安德斯‧科尔(Anders Corr),2001年获颁耶鲁大学的政治学学士和硕士学位,2008年获哈佛大学的政府管理学博士学位。他是《政治风险杂志》(Journal of Political Risk)出版商科尔分析公司(Corr Analytics Inc.)的总裁,其研究领域广涉北美、欧洲和亚洲等地。他的最新著作是《权力的集中:制度化、等级制和霸权主义》(The Concentration of Power: Institutionalization, Hierarchy, and Hegemony, 2021)和《大国大战略:南海的新博弈》(Great Powers, Grand Strategies: the New Game in the South China Sea, 2018)等。

原文:Misanthropic AI刊登于英文《大纪元时报》。

本文仅代表作者本人观点,并不一定反映《大纪元时报》立场。

责任编辑:高静#

如果您有新闻线索或资料给大纪元,请进入安全投稿爆料平台

留言

  • 大纪元保留删除恶意留言的权利,包括低俗、误导或攻击信仰等内容
本网站图文內容归大纪元所有, 任何单位及个人未经许可,不得擅自转载使用。
Copyright© 2000 - 2026 The Epoch TimesAssociation Inc.All Rights Reserved.