大紀元

【名家專欄】需要管控中共人工智能模型

【名家專欄】需要管控中共人工智能模型
2024年2月26日,在西班牙巴塞羅那舉行的世界移動通信大會(Mobile World Congress,簡稱MWC,全球電信行業年度最大盛會)上,一位參觀者正在查看手機旁邊的OpenAI標誌。(Pau Barrena/AFP via Getty Images)
2026-08-0507:42 中港台時間|08-0508:28 更新
人氣 74

【大紀元2026年08月01日訊】(英文大紀元專欄作家Anders Corr撰文/信宇編譯)在最近一次對兩款OpenAI模型的測試中,它們突破了本應與互聯網隔離的「沙盒」(Sandbox)環境,並入侵了另一家美國公司「抱抱臉」(Hugging Face,總部位於紐約)。OpenAI將這起由人工智能(AI)自主發動的攻擊稱為「前所未有」(Unprecedented)。

遭到入侵的抱抱臉公司是一家提供開源AI工具的公司。這兩款OpenAI模型,包括GPT‑5.6 Sol,以及另一款尚未發布、能力更強的模型(除了曾短暫發布過一次之外),認為入侵抱抱臉公司能夠幫助它們在OpenAI的評估測試中作弊。

該事件凸顯了AI模型失控的風險,它們可能自行行動,而不是聽命於人類管理者,闖入互聯網的蠻荒之地,甚至造成持續性的危害。

抱抱臉公司(Hugging Face)最初向安特羅匹克公司(Anthropic,總部位於加州舊金山)的Fable模型請求幫助,希望它協助抵禦這次攻擊。但是後者拒絕了前者的網絡安全協助要求,理由是擔心攻擊者可能偽裝成防禦方提出請求。即使是最先進的AI模型,也並非總能區分攻擊者(Attacker)和防禦方(Defender)。Fable的安全防護機制隨即啟動,依照其一般規則,除了少數大型企業與政府機構外,該機制通常都會拒絕處理網絡安全相關請求。

隨後,抱抱臉公司轉而使用智譜公司(Z.ai,總部位於北京)的GLM 5.2,這是一款中國開發的、相較之下設有較少的安全防護措施的模型。抱抱臉公司聲稱,GLM 5.2使用起來更簡單、更快速、更經濟、更安全。攻擊者的數據(例如惡意程式碼、攻擊樣本、測試案例等)和防禦方的憑證(如API金鑰、帳號密碼、存取權等敏感資訊)均未離開抱抱臉公司的計算環境,沒有傳送到外部公司的雲端或伺服器。

抱抱臉公司對這款中國模型的讚揚,想必對中共政權來說,正合其心意。

GLM 5.2使用開放權重(open weights)模式。開放權重模型可供使用者下載,並依照自身需求修改。這意味著,當美國三大科技公司——安特羅匹克(Anthropic)、OpenAI和谷歌(Google)——的安全防護機制(Guardrails)起到阻礙時,這類模型可能對防禦方有用。

然而,一旦開放權重模型被下載,開發這該模型的公司就對其失去了控制權,這增加了威權政權、黑客或恐怖分子濫用它從事惡意行為的風險。智譜公司之所以能在抱抱臉公司黑客事件中派上用場,正是因為它缺乏同樣的安全防護措施;而同樣的特性,也可能使智譜公司模型成為惡意行為者的工具。

因此,解決之道未必是像抱抱臉公司所推崇的那樣,採用開放權重或取消安全防護機制,而是在合乎道德的私人AI系統中建立更好的安全防護機制,從而使這些系統完全無法被用於惡意目的。

中國公司生產的AI模型最終都受中共政權的控制,中共可能會試圖在這些模型中植入親中共的偏見,或者插入後門程式,使中共政權能夠入侵模型用戶的系統。

中國的AI模型有時會通過「蒸餾」(Distillation)方式竊取美國模型的成果。「蒸餾」是指讓功能較弱的模型,以功能較強的原始模型(例如安特羅匹克、OpenAI與谷歌等美國公司推出的模型)所產生的資料進行訓練。這種做法涉及竊取知識產權,而這些源自竊取的成果,也更可能被用於惡意用途。

白宮聲稱,有信息表明,中國AI新創公司「月之暗面」(Moonshot AI,總部位於北京)通過對安特羅匹克公司Fable人工智能模型進行「蒸餾」,開發出了其功能強大的Kimi K3模型,並且很可能透過泰國取得了(英偉達公司的)GB300芯片進行訓練,這違反了美國的出口管制規定。安特羅匹克公司回應稱,大規模進行模型「蒸餾」已對美國及其民主盟友的國家安全構成威脅。

安特羅匹克(Anthropic,總部位於加州舊金山)是一家成立於2021年的美國人工智能公司。(Riccardo Milani/Hans Lucas via AFP via Getty Images)
安特羅匹克(Anthropic,總部位於加州舊金山)是一家成立於2021年的美國人工智能公司。(Riccardo Milani/Hans Lucas via AFP via Getty Images)

雖然美國的AI模型整體而言在該領域居於領先地位,但是中國在免費開放權重模型方面占有優勢,這使得中國模型在全球應用和用戶數量方面更具競爭力。這種優勢可以說是通過模型「蒸餾」竊取美國技術而不公平取得的。

美國正在考慮對涉及這類盜竊行為的責任人或機構實施制裁。美國財政部長斯科特貝森特(Scott Bessent)在X社交平台上發文表示:「當(中國)公司進行祕密的、大規模的模型蒸餾攻擊,並越過界限構成知識產權盜竊時,美國將考慮祭出制裁,並將相關企業列入『實體清單』(Entity List)。」

由於中國的開放權重模型的安全防護機制較少,且目前受到中共的控制,因此其造成危害的風險尤其高。中共具有極權、種族滅絕與霸權擴張等目標,而在中共掌控下發展與運用的AI技術,可能會助長這些目標的實現。

中國的AI模型可能會宣傳中共的一些危險的威權主義政策,也可能透過入侵毫無戒心的受害者的電腦網絡、自行植入黑客内容,而導致失控。

面對中國的開放權重模型可能失控,或被用於威權統治、黑客攻擊及恐怖活動的風險,解決之道並非接受缺乏安全防護機制的高風險開放權重模型。相反,全世界需要建立更完善的安全防護機制,使其能夠區分合法防禦方與攻擊者,並對惡意行為者濫用開放權重模型採取更強硬的管理措施。

開放權重模型落入惡意行為者手中的威脅已近在眼前,因此世界各國必須儘快採取行動。一旦恐怖分子、獨裁者或黑客將開放權重模型下載到自己的伺服器上,情勢可能就難以挽回了。他們中有人可能打造出一種仇視人類(Misanthropic)的AI技術,使其像病毒一樣在防護不足的伺服器上自我複製,其目的不是幫助人類,而是摧毀人類。

作者簡介:

安德斯‧科爾(Anders Corr),2001年獲頒耶魯大學的政治學學士和碩士學位,2008年獲哈佛大學的政府管理學博士學位。他是《政治風險雜誌》(Journal of Political Risk)出版商科爾分析公司(Corr Analytics Inc.)的總裁,其研究領域廣涉北美、歐洲和亞洲等地。他的最新著作是《權力的集中:制度化、等級制和霸權主義》(The Concentration of Power: Institutionalization, Hierarchy, and Hegemony, 2021)和《大國大戰略:南海的新博弈》(Great Powers, Grand Strategies: the New Game in the South China Sea, 2018)等。

原文:Misanthropic AI刊登於英文《大紀元時報》。

本文僅代表作者本人觀點,並不一定反映《大紀元時報》立場。

責任編輯:高靜#

如果您有新聞線索或資料給大紀元,請進入安全投稿爆料平台

留言

  • 大紀元保留刪除惡意留言的權利,包括低俗、誤導或攻擊信仰等內容
本網站圖文內容歸大紀元所有, 任何單位及個人未經許可,不得擅自轉載使用。
Copyright© 2000 - 2026 The Epoch TimesAssociation Inc.All Rights Reserved.