舊金山消息:紐約時報在周四(9月17日)公開的一份法院文件指,OpenAI 在以百萬篇新聞文章訓練其人工智能模型的過程中,犯下了一宗前所未有、驚人規模的竊取行為。
這間總部設在舊金山的人工智能實驗室,從超過一千萬篇文章中撈取內容,其中近三分之一的來源僅來自紐約時報。
該文件稱,微軟應用科學部主管布倫特·赫克稱其為「前所未有、驚人規模的竊取」,甚至指稱可能是「人類歷史上最大的勞動剽竊」。
赫克亦疑稱 OpenAI 在嘗試辨識其系統中來自紐約時報及本訴訟其他原告的內容時,可能涉入「意外的掩蓋行為」。
微軟稱赫克的說法只是「一名員工的個人觀點」,並不代表公司的立場,一位微軟發言人向法新社表示。
該報於三年前在美國紐約聯邦法院起訴 OpenAI 與微軟,指控他們盜用其受版權保護的素材,訓練 OpenAI 的旗艦模型 ChatGPT。微軟於 2019 年首次投資 OpenAI。
另外有多家新聞出版商加入訴訟,包括 Ziff Davis——擁有 CNET 及其他科技新聞刊物——以及《Mother Jones》母公司、調查新聞網站 The Intercept,以及全美多家地方報紙。
他們為每篇被指控盜取並被 OpenAI 模型使用的文章尋求賠償,目前尚不清楚總罰款可能達到多少。
自 2022 年底推出 ChatGPT 以來,OpenAI 已與全球多家新聞出版商簽署內容授權協議,但外界依然擔心生成式 AI 軟件會導致網路新聞網站的流量下降。
AI 公司曾嘗試透過在使用者查詢中加入帶有連結的引用以化解這些擔憂,但此舉被批評為不足。
「不管我哋點樣突出顯示連結,使用者都唔會點擊,」根據法院文件,OpenAI 自己的一名工程師承認。
微軟與 OpenAI 爭辯稱,他們對新聞內容的使用具有變革性,屬於「合理使用」法例之範疇。
九月初,美國司法部提交了一份支持 OpenAI 與微軟的陳述,援引「科學進步」、經濟增長以及「國家安全」。
原告尋求作出對自己有利的摘要判決。
若美國地區法官 Sidney Stein 同意,案件將不再進入審判,但預計要到 2027 年才會有裁決。