美国司法部向曼哈顿联邦法院递交了一份”利益声明”(statement of interest),在《纽约时报》诉 OpenAI 与微软一案中站到了被告一侧。文件的核心主张只有一句话:用受版权保护的作品训练大语言模型,构成合理使用。
案子由纽约南区联邦地区法院法官 Sidney H. Stein 审理。《纽约时报》2023 年底提起诉讼,指控两家公司未经许可拿其报道训练 ChatGPT,双方均已提出简易判决动议,Stein 把提交截止日定在本周五。司法部赶在这个节点递文件,时间点选得很准。
论证落在”转化”两个字上
司法部的推理路径是:训练过程从源材料里学到的是泛化的关系,模型本身并不分发源材料,所以这种使用具有高度转化性。文件进一步把 AI 研发与科学进步、国家安全和美国经济竞争力挂钩,称其带来的收益远超对原作市场造成的竞争损害。
副总检察长 Stanley Woodward Jr. 把这份文件称为”a historic statement of interest”,并援引总统的判断——“AI dominance is critical to promote national security, prosperity, and economic mobility”。同一天,美国官员在 G20 场合呼吁各国在保护创作者的同时为 AI 训练留出空间,两处口径一致。
它能做什么,做不到什么
利益声明不是判决,对法院没有约束力。它能提供的是行政部门的政策视角,影响法官搭建分析框架的方式;它替代不了合理使用四要素的逐条衡量,尤其第四项——使用行为对原作潜在市场的影响,而这一项恰恰是新闻出版方最吃劲、也最可能翻盘的地方。整个 AI 行业也不会因为一份意见书就获得版权豁免。
《纽约时报》发言人 Graham James 的回应措辞很硬,批评政府站在”trillion-dollar AI companies”一边,称这种做法会”undermine the sustainability of the human-created content that a healthy society depends on”。
溢出效应比判决来得快
参照系就在眼前:Anthropic 今年以 15 亿美元和解了一桩图书版权案,此前法官认定其非法下载了受版权保护的书籍。那起案子的争点落在获取数据的手段上——盗版书源,与训练行为本身可以分开看。司法部这次同样绕开了数据来源,只谈训练环节的性质。
这个切分决定了未来几年谈判桌上的筹码分配。假如法院接受”训练即转化”的框架,音乐、图书和新闻行业能主张的就收窄到取数手段是否合法一项,索赔口径会明显缩小,授权费的定价基础也跟着松动。粗算一层外溢:国内厂商采购中文语料和影视音乐版权时,参照的一直是海外授权成交价,美国这边把训练默认划进合理使用,卖方的报价锚点会往下挪。
判决还没到。下一个节点是 Stein 手里那两份简易判决动议。
参考来源:美国司法部提交的利益声明、纽约南区联邦地区法院公开案卷、CocoLoop、GV Wire、DataStudios;法官姓名、案件当事方与 15 亿美元和解金额经两处公开报道交叉核对。