纽约时报诉讼披露微软和OpenAI内部文件:AI数据抓取被称为前所未有的劳动盗窃
在纽约时报领衔的版权诉讼中,未删减的微软和OpenAI内部备忘录被提交法庭,显示高管将大规模内容抓取形容为史上最大劳动盗窃,并警示其可能导致收入恶性循环。

在《纽约时报》领衔的版权诉讼中,原告向法庭提交了未经删减的微软和OpenAI内部备忘录,这些文件首次公开了两大科技公司如何看待在生成式人工智能模型中大规模抓取受版权保护内容的内部论述。
这些材料包括电子邮件、内部报告以及高管会议纪要,均在进入法院记录前未经过任何审查,信息来源依据Ars Technica于2026年9月17日的报道以及Golem.de于2026年9月18日的报道。
高管语言将此行为称为前所未有的盗窃
一份内部备忘录引用微软应用科学总监Brent Hecht的话,将大规模内容抓取形容为“人类历史上最大的劳动盗窃”,并在同一文件中表达了对公司依赖公平使用辩护的合理性的内部质疑。
Hecht的评论在法庭文件中出现时并非法律分析,而是个人观点,随后微软在公开声明中强调该言论不代表公司官方立场。
潜在的经济反馈循环
另一份微软内部文件警告称,AI产品使用受版权保护的内容可能导致原始内容生产者收入下降,进而削减未来模型训练可用的材料,形成一种“破坏性循环”。
该备忘录指出,这一循环若持续,可能危及整个出版生态系统的长期健康,这一点在原告的诉状中也被反复强调。
流量下降与用户行为的证据
原告提供的数据表明,在AI生成答案取代原始文章后,部分标题的点击率下降幅度在83%至93%之间,其他标题则在51%至94%之间,这些数字作为证据提交,尚未构成法院的裁定事实。
OpenAI内部信息显示,一些员工认为当答案已经在AI响应中提供时,用户点击链接的意愿显著降低,这进一步支持了出版商关于流量下降的主张。
- Brent Hecht称抓取为“人类历史上最大的劳动盗窃”
- 微软警告内容生产者面临破坏性收入循环
- Satya Nadella作证称AI助手可直接提供信息取代访问原站点
- OpenAI员工预期预生成答案会导致点击率下降
微软首席执行官Satya Nadella在宣誓作证时表示,AI助手能够直接提供用户所需信息,从而有效取代用户访问原始来源的行为,这与内部对流量损失的担忧相呼应。
原告还指控发现了一种付费墙规避技术,使第三方供应商能够在商业使用限制下获取约180万篇《纽约时报》文章,并将其用于模型训练。
微软回应称,被引用的言论仅代表个别员工的观点,并不构成公司官方法律立场,微软和OpenAI仍坚持其使用受版权保护材料属于公平使用范围,案件尚未出现法院对实质性指控的裁决。
截至目前,法院尚未对这些指控作出实质性判决,这些内部文件仍作为证据记录在案,案件正向实质性裁决推进。
对中国出版行业的启示
对于中国的出版机构和内容平台而言,这些内部文件的公开意味着依赖AI生成内容的企业面临更高的法律风险。内部对公平使用的质疑以及量化的流量损失提示,未来可能出现更严格的授权要求、更透明的数据来源规范,甚至提升基于受版权保护文本的大规模语言模型部署成本。
在北京、上海等地的出版企业已经开始关注美国案例的进展,并考虑在合同中加入更明确的数据使用条款,以防止类似的版权争议对业务造成冲击。
信息来源
- Microsoft exec called AI scraping the largest theft of labor in human historyArs Technica · 2026年9月17日
- Ungeschwärzte Dokumente belasten Microsoft und OpenAIGolem.de · 2026年9月18日



