北京:來自美國領先的人工智能開發商 Anthropic 的研究人員警告,日漸強大的模型可能會脫離人類控制,甚至導致人類滅絕,這些警告在中國引起關注;中國的政策制定者一直在為某些相同的風險做準備。
美國與中國是前沿AI發展及科技全球採用的兩大推動力。兩國在彼此的AI政策與產業實踐方面日益對立,這些議題將於九月晚些時候在雙邊會談中成為焦點議題。
儘管競逐開發日益強大的AI系統,但北京的監管框架與公開表態強調,先進AI逃脫有效人類監督的可能性被視為嚴重風險,必須有所規劃。
BEIJING FRAMES US CALLS AS “COORDINATED PLAY”
中國國家媒體對美國AI領導人的最新言論作出回應。
《中國日報》於周一(9月14日)刊發的社論指出,Anthropic 的 Dario Amodei、OpenAI 的 Sam Altman 以及 SpaceXAI 的 Elon Musk 提出遏制前沿AI發展的呼籲,被視為一項旨在維持美國主導地位的「協同作法」。
「三家公司之間的協調聽起來很像一個在公布嘉賓名單前就已草擬會員規則的俱樂部,」《中國日報》表示,並補充說「排除中國的全球AI安全框架並不能算是全球性的」。
與此同時,《環球時報》炮轟 Anthropic 要求放慢AI發展的呼籲,稱之為對中國的「冷戰戰略」。
其真正的議程是「透過技術壁壘與監管壟斷遏制中國的AI發展,維護華盛頓在尖端科技的壟斷霸權,並將中國排除在全球AI治理體系之外」,周日刊登的一篇社論指出。
「這場所謂的『無聲的AI冷戰』既虛偽又短視,」《環球時報》說,並補充指出,若把中國排除在全球AI創新之外,將「顯著提高全球AI發展中的試錯成本與失控風險」。
外交部亦加入批評行列。
「恐嚇、對抗和惡性競爭只會擾亂全球AI治理的進程,亦對任何人都毫無好處,」發言人郭岐鈞於周一的例行記者招待會上表示。
「AI 的發展關乎全人類的福祉。各方應共同促進開放包容的AI發展,以造福所有人,」郭補充說。
BEIJING SEES AI AS MANAGEABLE RISK, NOT AN EXTINCTION EVENT
美國的辯論雖集中於前沿AI是否可能對人類構成生存威脅,但中國的決策者通常把AI視為一種強大但可治理的技術,其風險可以透過技術標準、監管與國家監督而被控制。
“中國與美國的專家在AI風險方面基本達成共識,” Beijing-與新加坡基地的 Concordia AI 的創始人兼首席執行官謝智文表示,並補充說,差異在於「風險的框架與優先順序的設定」。
中國並未提出像 Anthropic 所主張的在AI公司內嵌獨立監察機制的做法。相反地,其新興監管體系依賴開發者義務、國家背書的標準、安全評估與外部測試。
這種做法同樣受兩國AI產業差異的影響。
中國開發商日益推廣開放權重模型。這些模型指的是其底層參數可以下載、檢視與修改的系統。
然而像 Anthropic 與 OpenAI 這樣的美國領先對手,卻不公開這些規格。
CHINA SEEKS TO PREVENT ROGUE AI AGENT INCIDENTS
中國網絡空間監管機構、經濟規劃機構與工業部門於五月發佈的政策指出「運作失控」成為AI代理的安全風險,即相較於傳統聊天機器人,這類系統能更自主地規劃與執行多步任務。
該規定要求開發者提升探測、干預、阻止及從不當代理行為中恢復的能力。
政策亦要求開發者防範資料中毒、演算法操控及系統脆弱性等風險。它亦指示用戶需被告知代理的自主決策,並保留最終決策權。
中國亦已著手起草AI代理安全的強制性國家標準,Concordia 的謝表示,這將是全球同類標準中的首例。
網絡空間監管機構的高級官員王力宏於九月一日表示,需對前沿模型繞過沙盒環境、規避安全界限以及攻擊外部實際生產系統的情況保持特別警覺。
BEIJING SEES RISKS IN LEADING US MODELS
中國國家安全部長陳希欣在週日於政府機構刊物撰文指出,像 Anthropic 的 Mythos 與 OpenAI 的 GPT-5.5-Cyber 這類美國先進模型,可能對中國的關鍵信息基礎設施構成嚴重風險,並呼籲全面提升AI安全性。
Anthropic 與 OpenAI 尚未就路透社的置評請求作出回應。
中國的AI開發者多以開放權重模型為推廣,部分原因是因為資安團隊能夠檢視、修改並用於防禦性任務。
模型倉儲平台 Hugging Face 表示,使用中國 Z.AI 開發的 GLM-5.2 開放權重模型,分析七月由逃脫自受限美國模型的 OpenAI 代理人入侵事件,因更嚴格限制的美國模型在取證工作中不太有用。
但專家亦強調開放權重模型的風險,這類模型可在監管甚微的情況下被修改與再分發。
Moonshot 的 Kimi K3 上月繞過英國 AI 安全研究所的測試沙盒,研究人員表示,這凸顯出中國AI模型可能與美方同行一樣,躲避旨在限制其存取與行動的管控的風險。
路透社就此事向 Moonshot 徵詢意見時,Moonshot 未予回應。
REGULATORS FLAG AI “LOSS OF CONTROL” RISK
中國在2024年9月於網絡空間管理局(CAC)指導下發布的AI安全框架中首次明確加入「失控」的未來情景,作為一項風險考慮。
The document said it could not be ruled out that future AI might autonomously obtain external resources, replicate itself, develop self-awareness and seek external power, creating a risk of competing with humans for control.
The CAC released an expanded version in September 2025.
The newer framework sharpened the scenario, saying AI could undergo a sudden and unexpectedly large “leap” in intelligence before acquiring resources, replicating itself and seeking power. It also added a governance principle of “trusted application, preventing loss of control”.
A later expert interpretation published on the cyberspace regulator’s website said the new principle was intended to guard against loss-of-control risks threatening human survival and development and referred to a possible “AI breaking loose” scenario.
A DIFFERENT APPROACH TO “PACING”
China’s regulatory approach differs from calls in some Western AI-safety circles for developers to slow or pause development of the most capable models until stronger safeguards are in place.
It has instead since early this year pushed for the integration of AI into all industries, part of Beijing’s bid to make technology the new engine of the world’s second-largest economy.
But China has also shown it can delay deployment when officials believe governance has not caught up.
In 2023, Chinese companies delayed chatbot launches for months while the CAC finalised rules governing generative AI services. Companies released a number of major products after the rules took effect in August that year.