Anthropic 表示,該公司多年前已持續關注一日 AI 模型可能會發展至有能力協助現有病原體變得更具危害性,甚至創造全新病原體的風險,並在周四(9月10日)發布的報告中作出說明。
同時,該公司在最新的「威脅情報」報告中指控中國競爭對手有針對性駭客企圖提取 Claude 的能力,該報告在過去八個月內記錄了其技術的惡意使用情況。
隨著越來越多由流氓 AI 代理所發起的非法駭客攻擊事件增多,以及業界內部對該技術風險的關注不斷升高,行業領跑者正面臨更強的監管壓力,這也提高了未來可能出現更多規範的前景。
本周有兩位 Anthropic 的研究人員警告,人工智能的快速發展在不久的將來可能會帶來人類滅絕的風險。
MISSILES, DRONES AND BIOLOGICAL WEAPONS
在該報告中,Anthropic 表示長期以來就擔心 AI 模型有一天可能具備協助提升現有病原體危害性或創造全新病原體的能力。
他們記錄了五宗科學家以其模型進行的用法,這些用法可能支援生物武器的研發。
其中一起案例顯示,一名位於 Anthropic 尚未覆蓋的地區的研究人員,透過虛擬私有伺服器基礎設施存取 Claude,並連續數週用它規劃禽流感向哺乳動物適應的實驗。
Anthropic 尚未涵蓋的地區包括俄羅斯、中國、北韓等國家等。
在偵測到這些濫用行為後,該公司禁止涉案研究的帳戶,並將這些發現納入其前沿模型的安全機制、執法程序與威脅情報流程中。
Anthropic 並未披露涉事機構、其所在國家,以及涉及的具體生物致病因子與研究技術。
報告亦指出所謂「新類別威脅行為者」濫用 Claude 的案例。其中包括利用該平台「開發常規武器的軟件」,包括槍械、導彈、武裝無人機、炸彈以及其他軍械的設計與操作系統等。
報告詳述在中國、俄羅斯與也門等地的操作人員利用 Claude 來開發武器設計與研發軟件,或支援與武器計畫相關的情報蒐集與採購工作。
Anthropic 表示,其模型的快速進步帶來新的風險,威脅情報主管 Jacob Klein 對路透社指出。
「也就是說,一年前若要優化無人機的性能或導彈軟件,當時的模型在該任務上的表現遠不及現在,」他說。
RUSSIAN HACKERS USE ANTHROPIC AI AGAINST UKRAINE OFFICIALS
Anthropic 指出,駭客及有國家背書的入侵者正日益使用 AI 來籌畫與執行網絡攻擊的大部分階段,人體僅負責監督而非實際操作。
「AI 的使用已經超越對話機器人的簡單問答,而是涉入多代理框架的運作,」報告稱。
一個駭客組織據稱對烏克蘭政府、軍方和外交部門的目標實施了網釣、酒店 Wi-Fi 劫持以及 WhatsApp 設置與接管等作業,幾乎在每個階段都使用了 AI。
該組織的作戰手法與以俄羅斯為基地的威脅行動者 Midnight Blizzard 相符,美國政府先前曾將其與俄羅斯外長情報局(SVR)聯繫起來。
位於華盛頓的俄羅斯大使館尚未就置評請求作出回應。
該組織據稱利用 AI 建立一個自動偵測其惡意軟件被安全防護機制標記的系統,並在被標記後不斷改寫程式碼直到能避開檢測。
Anthropic 同時偵測並阻止與 ShinyHunters 集體相關的活動,該聯盟目前是全球最活躍的網絡犯罪集團之一,與全球多家大型企業遭受攻擊有關。
CHINESE AI LABS RUN ATTACKS TO EXTRACT CLAUDE CAPABILITIES
Anthropic 稱,在報告期內,已制止來自七家位於中國的實驗室的攻擊,其中包括阿里巴巴、Moonshot、DeepSeek 與 小米等。
這些公司尚未就置評請求作出回覆。
與阿里巴巴相關的攻擊操作人員被指控進行了該公司所謂「最大規模的非法蒸餾」攻擊,據稱目標是提取 Claude 模型的能力,並用於提升該中國科技公司 Qwen 模型的性能。
Anthropic 表示在 2026 年 5 月至 7 月期間,觀察到超過 1.51 億次的與阿里巴巴相關的互動,日峰值接近 300 萬次,來自超過 3,500 個被其描述為欺詐的帳戶。
所謂蒸餾是指利用較大、成本較高的模型的輸出,訓練較小的 AI 模型,以降低訓練新工具的成本。
在另一種濫用其技術的情況中,Anthropic 指出 Kimi 聊天機器人的開發商 Moonshot 與 DeepSeek 被指控把實時客戶對話(有時包含敏感資訊)透過 Claude 進行處理,並將其回應用作訓練資料。
中國外交部表示,該部尚未得知這份報告,政府重申 AI 應用於善、反對扭曲事實及抹黑中國。