美國政府支持 OpenAI 訓練立場,但《紐時》訴訟未有判決
Tech News

美國政府支持 OpenAI 訓練立場,但《紐時》訴訟未有判決

圖片:TechLab 自製資訊圖
TechLab 編輯部(譯)·

特朗普政府就《紐約時報》控告 OpenAI 的版權訴訟提交一份 20 頁意見書,支持 ChatGPT 開發商以未獲授權的受版權作品訓練大型語言模型(LLM)的立場。這對 OpenAI、出版商、創作者及依賴生成式 AI 的產品團隊都有指標意義;但最重要的限制很清楚:意見書並非判決,案件仍由美國紐約南區聯邦地區法院審理,撰寫意見書的政府一方也無權就案件作出裁決。

事件的焦點不只是「AI 可否讀取網上內容」。LLM 訓練涉及極大量已出版作品,包括書籍、文章及其他媒體;出版商主張,AI 公司未經許可把這些材料納入訓練資料,可能構成侵權。OpenAI 一方及政府意見書所支持的方向,則是將問題放到美國版權法的 fair use 框架內,主張訓練用途可被視為具轉化性,並有助維持美國 AI 產業的競爭力。

政府意見書支持甚麼,沒有決定甚麼

該份意見書把政策考量放在前面,稱美國有強烈利益發展具競爭力的 AI 產業,並維持全球 AI 領導地位;其論點是,若錯誤理解 fair use 而過度限制 LLM 開發,會阻礙創意、科學進展、經濟繁榮及流動性。換言之,政府正在向法院表達一項取向:在詮釋版權例外時,應把大規模模型訓練的創新及產業利益納入考慮。

不過,這不等於政府已替 OpenAI 證明其訓練做法合法,更不代表《紐約時報》的所有主張都已被否定。法院仍須處理具體事實及法律問題,包括相關使用是否足夠「轉化性」以構成 fair use。政府意見可能有說服力,尤其在案件觸及國家產業政策時,但法官毋須照單全收。把新聞理解為「OpenAI 勝訴」會過度延伸;較準確的說法是,OpenAI 在一宗仍在進行的關鍵案件中,獲得聯邦政府公開支持。

fair use 的爭議,在於訓練與取代之間的界線

來源所述的法律辯論集中於轉化性:AI 公司使用受版權作品,是為了產生有別於原作的模型能力,還是以另一種方式重製、取代原作的價值?這個問題難有一條簡單界線。模型訓練的輸入是既有作品,輸出卻可回應全新的查詢;然而,權利人關心的並不只是輸出是否逐字相同,也包括未獲許可使用大量作品訓練,會否削弱原內容的授權市場與商業位置。

因此,政府提出「不要限制創新」的論點,沒有消除創作者的利益衝突,只是更著重創新及產業政策方面的考量。若法院接納較寬闊的 fair use 詮釋,AI 公司會有較大空間把訓練視為研究及技術開發的一部分;若法院採取較收窄的看法,業界可能要更重視取得授權、記錄資料來源及調整訓練流程。這是分析上的可能後果,最終仍取決於法院對本案事實的裁斷。

TechCrunch 提到,過往有關 AI 訓練及版權的案件整體上較有利 AI 公司,但這也不表示所有取得資料的手法獲認可。報道以 Anthropic 與作家群體的和解為例:法官 William Alsup 命令 Anthropic 支付 15 億美元版權和解金,爭點在於公司使用非法影子圖書館盜版書籍,而非單純的 AI 訓練本身。該案的脈絡提醒業界,資料如何取得,與資料其後如何用於訓練,可能是兩個必須分開看的問題。

對 AI 產品團隊:合規不能只看模型輸出

對開發使用 ChatGPT 或其他生成式 AI 的產品團隊而言,這宗案件短期不會改變工具能否使用,但它會影響採購及風險評估的問題應該問得多仔細。不能只問模型會否產生相似內容,亦應分辨供應商對訓練資料、授權、內容保障及使用條款有何說明。尤其是把 AI 接入內容生產、搜尋、知識庫或面向客戶功能的團隊,應清楚界定輸入到系統的自有資料、可分享資料與第三方內容,避免把訓練爭議與自身資料處理混為一談。

這並不表示每個 app 都要自行判定美國版權法,更實際的做法是把法律不確定性當作供應鏈風險處理:保留內容來源及授權紀錄、核對合作方條款、為高風險用途安排人手覆核,並留意模型供應商日後因訴訟或商業安排而修改政策。政府意見書若強化業界對 fair use 的信心,可能令產品推出節奏更進取;但案件尚未判決,過早假定規則已定,對重視內容資產的公司並不穩陣。

對創作者與香港用戶:把它視為規則未定的海外訊號

對內容創作者而言,事件顯示爭議已從「模型是否抄襲單一作品」擴展至「訓練階段可否毋須先取得許可」。即使模型公司最後在 fair use 論點上取得較有利結果,市場對內容授權、資料來源透明度及創作者補償的討論,預料仍會持續。創作者如有向 AI 平台、出版商或客戶提供作品,仍應按自己作品的商業價值、合約條款及可接受的再利用範圍,審視授權安排,而非單憑這份意見書判斷權利已失去保障。

香港並不屬於美國 fair use 制度的管轄範圍,不能把本案可能形成的美國結論直接套用到本地版權法。不過,OpenAI 等主流生成式 AI 的訓練版權規則,仍會影響香港用戶、創作者及開發者判斷工具風險、內容授權與合作條款。對一般 ChatGPT 用戶來說,這則消息不會自動改變日常使用權限;對以 AI 處理客戶內容、出版內容或建立商業功能的人,則應避免把政府表態當成一張通行證。

接下來最值得觀察的是紐約法院如何處理轉化性與具體侵權主張,以及案件程序中會否更清楚區分「訓練本身」和「以非法來源取得訓練材料」。判決或後續法律意見一旦出現,影響不只在 OpenAI 與《紐約時報》之間,也會為 AI 公司、內容權利人及使用生成式 AI 建立產品的團隊,提供更具體的風險訊號。在那以前,這份意見書可視為重要的政策風向,但規則仍未落實。

延伸閱讀

AI 輔助說明: 本文由 AI 協助整理,並經兩輪獨立自動品質審核;資料及連結仍以原始來源為準。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook