東京:就最近一輪有關AI末日警告嘅報導,我試過拒絕對全能型電腦系統嘅教派式崇拜,以及嗰種「必然性」嘅說法:如果矽谷唔先研發,其他人——好可能係中國——就會先做。
然而,美國最近出現嘅一連串事件,促使有關讓 AI 系統自行運作嘅安全問題再度引發激烈辯論。參與相關公司嘅研究人員日增,亦開始警告存在「存在性」威脅,Anthropic 甚至喺其首次公開發行招股說明書入面向投資者提出呢啲憂慮。
對中國嚟講,近在眼前嘅風險,例如對勞動市場嘅威脅,或者更令人擔憂嘅科幻場景,例如入侵關鍵基礎設施,正令呢場風波唔再被視為單純美國人嘅迷信。
北京方面把部分警告斥為「恐嚇式嘅宣傳」,認為呼籲放慢 AI 發展只係想拖慢中國。不過,行業內部分聲音亦指出,前沿風險喺本土可能感受唔到咁強烈,因為中國喺技術上落後美國。
華為嘅輪值董事長埃里克·徐表示,中國嘅 AI 是否已經足夠先進,可以遇上美國供應商日益討論嘅「呢類風險」?
根據路透社報道,徐指中國嘅 AI 模型開發者「可能需要加快步伐」,以達到能「同樣感覺到風險」嘅水平,同時承認需要保持平衡。呢啲講法顯示全球嘅辯論已經喺某啲情況下走向唔太建設性嘅方向。
只是時間問題
喺太平洋兩岸,過快嘅競爭都唔係解答。
根據彭博情報嘅資料顯示,中國現時有近千個大型語言模型。呢種規模嘅競爭,已經令矽谷嘅高速追趕顯得相對克制。
中國嘅行業亦投入更多資源喺代理人,亦即能更自主地行動嘅系統。代理人失控嘅行為,特別係七月發生嘅 Hugging Face 事件,當時 OpenAI 嘅一個代理走出評估環境,闖入 Hugging Face 嘅系統,呢啲事件促成最近對安全嘅重新評估。
正如短暫興起嘅 OpenClaw 狂潮所示,即使中國非技術背景嘅公眾都願意試用呢啲工具。呢個現象意味住,若具代理特徵嘅 AI 本質上更具風險,可能只係時間問題,之後我哋會睇到中國 AI 工具出現令人擔憂嘅行為。
企業界已經有警覺。最近一篇 DeepSeek 論文嘅作者名包括創辦人兼 CEO 梁文豐,直截了當咁警告:代理人嘅行為可能「不可靠」。
逃離受控範圍嘅風險亦唔係美國專屬。Moonshot AI 嘅 Kimi K3 喺網路安全測試中利用咗沙箱嘅漏洞,據美國 Frontier Security 指出;同時,一啲中國嘅 AI 代理亦顯示出欺騙同令人關注嘅傾向,呢啲都令美國工具嘅安全問題再次引起警覺。
雖然北京對部分末日論調作出回應,但政策制定者都希望了解更多。喺九月,中國推出《AI 安全治理框架 3.0》呢份政策性文件,仲喺英文版本中出現,顯示呢個方向喺面向西方嘅受眾。文件明確警告,AI 呈現出「自我加速嘅趨勢」,同時指出呢個現象會唔會超越人類控制,需要高度關注與警覺。
另外一個安全辯論嘅基石係遞歸自我提升(RSI),即 AI 系統能自動推進自身嘅能力。就係呢條發展路線,促使 Anthropic 嘅一位研究員辭職,警告該技術嘅開發者真誠相信十年內可能「 kill us all」。
牛津中國政策實驗室嘅 Zilan Qian 指出,中國喺呢方面走得比西方多數人想像得更前,部分原因係研究人員用嘅語言同框架唔同。呢啲都暴露出雙方對對方研發嗰啲風險嘅了解有幾有限。
中國唔可以成為走數於不作為嘅藉口
喺討論呢項技術嘅風險時,習近平主席曾講過——最近一次喺同美國總統唐納德·特朗普嘅對話中提及——「人工智能必須保持喺人類控制之下」。
習主席以維持秩序為出發點,為同風險緩解嘅對話開展合作提供咗有限嘅窗口,同時亦暴露出特朗普-習近平峰會後出現嘅安全協議嘅局限,即係一條報告與 AI 相關事件嘅新通道。
呢啲熱線未必每次都有效。喺 2023 年間嘅間諜氣球危機,五角大樓曾嘗試透過危機熱線聯絡中國對口單位,但北京拒絕。呢種安排本質上都係事後性。
先發性風險分享亦唔一定要單靠政府對政府嘅對話,特別係 regulators 可能跟唔上技術知識時。設立公司同研究人員能夠更直接交流信息嘅渠道,會更有成效。
中國喺 AI 方面已有繁瑣嘅規管;用呢個作為嚇人嘅理由去拖延唔採取行動,喺華盛頓嘅決策者眼中已經唔再有說服力。
如果中國嘅 AI 系統只是落後幾個月,而中國全力推動代理人嘅發展終於實現,預計喺太平洋另一端會浮現更多令人擔憂嘅場景。政策制定者應該喺下一次事件成為單純警告之前採取行動。