美司法部挺OpenAI 稱訓練屬合理使用

美國司法部向曼哈頓聯邦法院遞交了一份「利益聲明書」(statement of interest),在《紐約時報》控告OpenAI與微軟一案中,選擇站在被告一方。文件的核心主張只有一句話:用受著作權保護的作品訓練大型語言模型,構成合理使用。

此案由紐約南區聯邦地方法院法官Sidney H. Stein審理。《紐約時報》於2023年底提告,指控兩家公司未經授權,拿其報導訓練ChatGPT,雙方目前都已提出簡易判決聲請,Stein將本週五訂為提交期限。司法部選在這個時間點遞件,時機抓得很準。

論證關鍵落在「轉化性」三個字

司法部的推理是:訓練過程從原始素材中學到的是通用化的關係,模型本身並不會散布原始素材,因此這種使用具有高度轉化性。文件更進一步把AI研發與科學進步、國家安全與美國經濟競爭力掛鉤,主張由此帶來的效益,遠遠超過對原作品市場造成的競爭損害。

司法部副助理總檢察長Stanley Woodward Jr.將這份文件稱為「a historic statement of interest」(一份具有歷史意義的利益聲明書),並援引總統本人的判斷——「AI dominance is critical to promote national security, prosperity, and economic mobility」。同一天,美國官員在G20場合呼籲各國在保護創作者的同時,也要為AI訓練留出空間,說法口徑一致。

它能做到什麼,又做不到什麼

利益聲明書不是判決,對法院也沒有拘束力。它能提供的只是行政部門的政策觀點,用來影響法官建構分析框架的方式;它無法取代逐項衡量合理使用四要素的工作,尤其是第四項——該使用行為對原作潛在市場造成的影響,而這恰好是新聞出版業者主張最有力、也最可能翻盤的地方。整個AI產業也不會因為一份意見書,就此獲得著作權豁免。

《紐約時報》發言人Graham James的回應措辭強硬,批評政府站在「兆美元規模的AI公司」那一邊,稱此舉將「損害健康社會所仰賴的、由人類創作內容的永續性」。

溢出效應比判決來得更快

眼前就有一個參照案例:Anthropic今年以15億美元和解了一起圖書著作權案,此前法官已認定該公司非法下載了受著作權保護的書籍。那起案子的爭點落在取得資料的手法——盜版書源——與訓練行為本身可以分開看待。司法部這次同樣繞開資料來源問題,只談訓練環節本身的性質。

這樣的切分方式,將決定未來幾年談判桌上籌碼的分配方式。假如法院接受「訓練即屬轉化性使用」這套框架,音樂、圖書與新聞業者能主張的範圍,就會收窄到取得資料的手段是否合法這一項,求償空間明顯縮小,授權費的訂價基礎也會跟著鬆動。溢出效應已有一層跡象浮現:國內廠商採購中文語料及影視音樂版權時,向來以海外授權成交價為參考基準,如今美國把訓練預設劃進合理使用範圍,賣方的報價錨點恐怕會跟著往下調整。

判決尚未出爐。下一個節點,是Stein法官手上那兩份簡易判決聲請。

參考來源:美國司法部提交的利益聲明書、紐約南區聯邦地方法院公開卷宗、CocoLoop、GV Wire、DataStudios;法官姓名、案件當事方與15億美元和解金額,經兩處公開報導交叉核對。