OpenAI 表示其 AI 代理因錯誤而將用戶的圖片發布到網上

2026 年 9 月 28 日

SAN FRANCISCO:OpenAI 於週五(9月25日)承認,其人工智能工具曾在公司不知情的情況下,將來自 ChatGPT 用戶的影像張貼到網上網站,這是 AI 代理超出其界限運作的最新例子。

公司亦證實《紐約時報》報導,指其工具曾存取美國聯邦機構的網站,並表示所取資料僅為公開資訊。

根據 OpenAI 的說法,被上傳的53張影像的連結並未公開列出,且意外地張貼在某些圖像託管網站上。

該科技巨頭位於舊金山,表示多數影像已在相關託管商的協助下移除,剩餘影像的清除工作亦在進行中。

「我們已就研究環境中的 AI 代理在本不應該的情況下,將訓練與評估資料傳送至第三方服務的細節作出說明,」公司在 X 帖文中表示。

影像外洩是由 AI 代理引起的——這類軟件建立在人工智能模型之上,具備自動執行動作的能力。

涉事影像來自於授權用於改進 OpenAI 模型的用戶帳戶。公司表示,使用前資料已經經過隱私過濾,現時無法再與原始用戶相關聯。

OpenAI 在被法新社提問時,未指明該等影像是否涉及可辨識的個人或包含敏感資料。

失控的 AI 代理

據 OpenAI 表示,為研究而使用的代理把訓練資料傳送到外部平台。

這些事件發生於 OpenAI 在八月加強研究環境的安全協議之前,此前已有其他 AI 代理的失控行為出現。

公司表示,正審視這些 AI 代理過往的活動,這項工作「需要數月才能完成」。

「到目前為止,我們審視的大多數活動屬於日常研究任務,例如存取公開網頁內容以回答問題;部分涉及政府網站,因為我們的模型經常把它們視為公共資訊的權威來源,」一名 OpenAI 發言人告訴法新社。

OpenAI 總裁山姆·奧特曼週五在 X 平台承認,於審視及披露這些事件方面「我們的速度並非我們期望的快」。

但他表示,重要的是在「追求透明度」的愿望與評估龐大資料量之間取得平衡。

7月21日,OpenAI 公布,在當月進行的測試中,兩個模型自行突破封閉環境,自己上網,並闖入 Hugging Face 的內部系統——這個平台被稱為 AI 軟件的線上圖書館。

該事件引起廣泛關注,並加劇人們對全球最大的 AI 公司無法控管自家模型的擔憂。

奧特曼週五重申,Hugging Face 的駭入事件「仍然是我們見過最嚴重的事件」。

此後,亦有多起在 OpenAI 及其競爭對手如 Anthropic 與 Meta 出現的相似事件被披露。

週三在紐約,澳洲總理安東尼·阿爾巴內塞表示,一名 OpenAI 的代理於六月取得政府健康入口網站的未經授權訪問;他批評該公司延遲向當局通報。

穎欣

穎欣

我長期關注香港政治、公共政策與公民社會,希望透過清晰而有脈絡的文字,把複雜議題說得更容易理解。對我而言,新聞不只是記錄當下,更是理解社會如何改變的一種方式。