微软声称 Copilot 很少复制《纽约时报》文章中的内容
核心要点
- 这一论点基于大量数据:微软在发现过程中将大约 820 万份 Copilot 聊天日志交给了新闻出版商聘请的专家。
- 它们是最有可能包含起诉微软的出版商复制内容的输出。
- 微软表示,在过滤后的池中,分析发现了 59,545 个 Copilot 的输出与原告的内容重叠的实例。
来源 CryptoBriefing作者 Editorial Team发布于 2026/9/4

这家科技巨头正在利用 820 万条聊天记录作为与新闻出版商进行高风险版权争夺战的证据。
微软希望联邦法院知道其人工智能聊天机器人不是抄袭机器。在回应《纽约时报》和其他出版商版权主张的新法律文件中,该公司辩称,Copilot 很少复制新闻文章中的完整句子,更不用说足以替代原始作品的大块内容了。
这一论点基于大量数据:微软在发现过程中将大约 820 万份 Copilot 聊天日志交给了新闻出版商聘请的专家。该公司表示,这些日志是经过精心挑选的,尽可能是最致命的。
防守背后的数字
微软在这里的法律策略本质上是统计性的。该公司声称,820 万条日志经过专门过滤,因为它们包含暗示使用新闻原告网站的关键字。换句话说,这些并不是关于周末晚餐食谱的随机对话。它们是最有可能包含起诉微软的出版商复制内容的输出。
微软表示,在过滤后的池中,分析发现了 59,545 个 Copilot 的输出与原告的内容重叠的实例。这大约占总样本的 0.7%,微软显然认为这个数字是无罪的。
具有广泛影响的诉讼
基本案件已合并在《纽约时报诉微软等人案》中。该诉讼最初于 2023 年 12 月在美国纽约南区地方法院提起。《泰晤士报》指控微软和 OpenAI 在未经许可的情况下使用其新闻报道来训练为 Copilot 和 ChatGPT 提供支持的人工智能模型,从而有效地创建了可以与原始报道竞争的工具。
此后,案件发生了重大变化。从 2025 年底到 2026 年初,发现纠纷愈演愈烈,围绕如何生成聊天日志以及原告专家可以访问哪些格式展开了争论。 2026 年 6 月,《纽约时报》修改了投诉,更加强调微软在促进版权内容使用方面的具体作用,而不是仅仅将该公司视为 OpenAI 的业务合作伙伴。
