美国司法部支持 OpenAI,认为限制人工智能训练数据会损害美国繁荣
核心要点
- 特朗普政府司法部在人工智能版权案件中提交了首份简报,称大型语言模型训练具有“非凡的变革性”,并将这场纠纷视为国家安全问题。
- 国家安全卡 也许司法部的论点中最具政治色彩的部分是其明确将人工智能培训视为国家安全问题。
- 对版权和人工智能的更广泛影响 司法部的简报不仅仅适用于《纽约时报》的案件。

特朗普政府司法部在人工智能版权案件中提交了首份简报,称大型语言模型训练具有“非凡的变革性”,并将这场纠纷视为国家安全问题。
美国司法部刚刚在人工智能时代最重要的版权之争中插上了自己的旗帜。在曼哈顿联邦法院提交的一份简报中,司法部辩称,在受版权保护的材料上训练大型语言模型属于合理使用,限制它会威胁美国的繁荣、经济流动性和国家安全。
该文件涉及《纽约时报》和 OpenAI/微软之间的合并诉讼,该案自 2023 年 12 月以来一直在法庭上审理。这标志着联邦政府首次正式干预围绕人工智能训练数据的任何规模庞大的版权纠纷。
政府的论点
司法部的核心主张很简单:当法学硕士在培训期间摄取受版权保护的文本时,它并不是在任何有意义的竞争意义上复制该文本。输出不会复制或替代原始作品。在政府的框架中,这一过程具有“非凡的变革性”,这是一个在合理使用分析中具有真正分量的法律术语。
该简报不仅仅是为人工智能训练机制辩护。它认为,限制数据访问将“严重阻碍科学和有用艺术的进步”,这种语言有意呼应版权法本身的宪法目的。
司法部副部长小斯坦利·E·伍德沃德 (Stanley E. Woodward Jr.)、助理司法部长布雷特·舒马特 (Brett Shumate) 和高级法律顾问迈克尔·韦斯布赫 (Michael Weisbuch) 都对这份文件做出了贡献,表明这不是中层员工的备忘录。
国家安全卡
也许司法部的论点中最具政治色彩的部分是其明确将人工智能培训视为国家安全问题。该简报认为,维持国内人工智能产业的主导地位符合美国“深远的国家利益”,过度限制性的版权解释可能会将竞争优势拱手让给外国对手。
中国是显而易见的潜台词,尽管有时没有明说。这一论点本质上可以归结为:如果美国人工智能公司无法使用高质量的英语数据进行训练,那么中国同行将不会面临类似的限制,而美国将在一场涉及巨大军事、经济和地缘政治利益的技术竞赛中落后。
对版权和人工智能的更广泛影响
司法部的简报不仅仅适用于《纽约时报》的案件。其推理延伸到涉及其他出版商、作者和创作者的相关版权纠纷,这些出版商、作者和创作者就训练数据实践起诉人工智能公司。通过阐明广泛的合理使用理由,政府正在有效地制定一个法律模板,该模板可能会影响数十起未决案件的结果。
关键的法律问题仍未解决:法学硕士培训的变革性是否超过了对版权持有者的潜在市场损害?法院历来对合理使用采用四因素平衡测试,权衡使用的目的和特征、受版权保护的作品的性质、使用的数量以及对原作市场的影响。
司法部的立场很大程度上依赖于第一和第四个因素。培训具有变革性,因为它不会以可识别的形式再现源材料。而且法学硕士的产出并不与他们接受培训的文章、书籍或创意作品直接竞争,至少在政府的说法中是这样。出版商显然会对第二点提出异议,认为人工智能生成的摘要和答案确实会蚕食受众的原创新闻和写作。
