「判《纽约时报》赢,会威胁国家安全」——美国司法部把一道版权题改写成了国运题
先说结论
9 月 2 日,美联社报道:在《纽约时报》诉 OpenAI 和微软的版权案里,美国司法部递交了一份「利益声明」(statement of interest),公开站到 OpenAI 一边,并给出一个扎眼的判断——如果法庭认定「用受版权保护的文本训练大模型」不属合理使用,将「威胁国家安全」,「让外国对手占得先机」。
政府替哪家公司说话,本身不算新闻,司法部在各类案件里递交这类声明是常规操作。值得盯的是论证方式:一道「训练数据该不该付费」的法律题,被改写成了「谁赢得 AI 竞赛」的国运题。措辞一换,答案就跟着换了。
事情是怎么发生的
《纽约时报》2023 年 12 月起诉 OpenAI 和微软,主张对方未经许可、未付分文,就把数百万篇报道喂进了模型;后来一批报纸、数字媒体和非营利新闻室陆续加入。它是目前关注度最高的一桩 AI 版权案,因为要回答的问题足够根本:拿别人的作品训练模型,算不算「合理使用」?
此前这条战线的实际走向都指向「要花钱」:Anthropic 以 15 亿美元和解了图书作者的诉讼,OpenAI 也跟多家大型出版集团签了授权协议。据尼曼新闻实验室报道,《纽约时报》为这场官司已花了超过 3000 万美元——它在赌一个判例,不是赌一笔赔偿。
然后司法部进场。文件主张:用这类内容训练大模型的「创意可能性与公共利益」,「远大于任何竞争损害」;判时报赢,会阻碍「创意与科学进步」,损害「美国的繁荣与经济流动性」。文件还做了一道切割:ChatGPT 偶尔逐字吐出时报原文,那是使用端的事,与训练是否侵权无关。
为什么重要
关键在国家安全那一段。司法部原话:AI 模型之所以能「重塑经济与国家安全」,是因为它们帮人「把事办成」;「创意上的收益常与国家安全利益重叠」,因为模型能帮「国家安全官员分析、推断那些(不受版权保护的)现实世界事实——比如《纽约时报》文章里传达的那些」。
这段话把底牌亮了:官员真正需要的是事实,而事实本就不受版权保护,版权保护的是表达。也就是说,文件里支撑「国家安全」的那部分内容,恰恰是版权法管不着的那部分。一个法律上说不圆的论点,被包装成了一个没人敢反驳的词。
这个夏天,官员和安全研究者拿「国家安全」论证的方向本来在另一头:模型越来越会自己动手,要加强看管。现在同一个词被反过来用,要求训练付费成了「危险的事」。同一个词,两个方向,都通向「别挡 AI」。这不是谁在撒谎,是个信号:AI 一旦被定义成国运行业,「国家安全」就会变成诉讼和立法里随手可取的筹码。
文件还有第二手,反垄断逻辑:如果 AI 公司都得为内容付费,钱会按「发表量」流进老牌大媒体的口袋,等于「大型科技公司因授权门槛在 LLM 训练上形成寡头」,而这套门槛「主要是给老牌主流媒体的巨额补贴」。版权被倒过来讲:它成了既得利益者的墙,不是小创作者的伞。
站得住与站不住的地方
站得住的:训练是否构成合理使用确实是个真问题,「训练属转换性使用」有法理传统可依;「训练归训练、产出归产出」的切割也并非胡搅蛮缠——时报最强的证据(逐字复现)大多发生在产出端。政府向法院表态,程序上无可指摘。
站不住的有两处。一是「国家安全」推论没有任何可检验的中间环节:授权付费以多大程度、在多长时间内损害安全,文件一个字没算。二是「小新闻室」这张牌打得不老实。据尼曼实验室的观察,现实恰恰相反:OpenAI 的授权费几乎只流向各国最大的出版集团,小媒体的内容被爬走了,钱一分没见着;授权判例反而可能让小出版方第一次拿到议价筹码。代表 The Intercept 的律师说得更直白:接受政府立场,等于「一场史无前例的、无补偿的知识产权从新闻机构向科技公司的转移」。
接下来该盯什么
三件事。一,法官接不接这套话术:利益声明没有拘束力,但会留在案卷里,如果后续裁决完全不提「国家安全」,说明法院没吃这一套。二,「训练/产出」的切割能否成立:若时报的逐字复现证据被允许进入训练侵权的认定,司法部最干净的那条线就断了。三,这套「约束 AI 即资敌」的话术,会不会从一份文件变成标准答案,出现在别的版权案里、国会的立法博弈里。到那一步,争的就不是这一案的输赢,而是往后所有 AI 争议,都用谁的尺子来量。