一、导语

2026 年 6 月,纽约时报(NYT)在一份经过修订的诉讼文件中扔下一枚重磅炸弹:微软专门为 OpenAI 建造了一台超级计算机,其核心目的之一就是大规模抓取和训练受版权保护的新闻内容。这一指控不仅把 NYT 与 OpenAI 之间持续近三年的版权诉讼推向了新高度,更首次将微软直接定位为「版权侵权基础设施」的建造者——而非仅仅是投资者。

修订后的诉状长达 137 页,其核心论点基于美国最高法院在 2025 年 对 Sony 案的里程碑裁决,重新构建了 NYT 对 OpenAI 和微软的版权侵权主张。与此同时,近 400 家 美国报纸联合在纽约南区联邦法院提起了针对微软和 OpenAI 的集体诉讼——这已不再是 NYT 一家的战斗,而是整个美国新闻行业对 AI 巨头的全面宣战。

二、背景分析:三年诉讼的演变

这场诉讼始于 2023 年 12 月 27 日,当时 NYT 在纽约南区联邦法院正式起诉 OpenAI 和微软,指控其未经授权使用 NYT 的数百万篇受版权保护的新闻文章来训练 GPT 系列大语言模型。这是美国主流新闻机构对 AI 公司提起的首批重大版权诉讼之一,在当时引发了整个科技行业的震动。

诉讼的关键证据是:NYT 展示了一系列「记忆」案例——ChatGPT 能够近乎逐字地复述 NYT 的付费文章内容,证明这些文章确实被纳入了训练数据集,且模型没有能力「忘记」这些受版权保护的文本。

在接下来的 30 个月 中,案件经历了多次关键转折:

三、核心内容:超级计算机的指控

修订诉状中最引人注目的指控,涉及微软为 OpenAI 建造的 Azure AI 超级计算机集群。NYT 声称,这台超级计算机的建设不仅仅是技术合作——微软明知 OpenAI 的训练过程涉及大规模版权侵权,仍主动为其提供算力支持。

超级计算机的规模

根据公开信息和诉讼披露,微软为 OpenAI 建造的超级计算机集群包括:

微软 Logo — OpenAI 版权侵权诉讼中的关键被告
微软作为 OpenAI 的最大投资方和算力提供方,被 NYT 指控为侵权行为的「直接参与者」

法律论据的更新

NYT 修订诉状的关键法律创新在于:它不再仅仅指控 OpenAI 和微软「使用了」NYT 的内容进行训练,而是运用最高法院在 Sony 案中的裁决,主张当明知内容被用于侵权用途时,为其提供「实质性帮助」同样构成侵权。具体来说:

「微软不能一边从 OpenAI 的成功中获取数十亿美元的回报,一边声称对 OpenAI 使用其超级计算机进行侵权训练的行为毫不知情。」
— NYT 修订诉状摘要,2026 年 6 月

四、各方反应

微软和 OpenAI 的回应:微软发言人在声明中表示,NYT 的新指控「没有法律依据」,强调 AI 训练属于「合理使用」(fair use)范畴,类似于搜索引擎对网页内容的索引。OpenAI 则重申其训练数据收集政策的合法性,并表示已与多家新闻机构签署了授权协议。

400 家报纸的联合起诉:就在 NYT 修订诉状提交的同一天,近 400 家 美国地方报纸通过其母公司向同一法院提起了集体诉讼。这些报纸包括《芝加哥论坛报》《丹佛邮报》《奥兰多哨兵报》等,代表了美国最大的报业集团之一 Tribune Publishing(现为 MediaNews 的一部分)旗下全部报纸。原告律师称,被告「未经授权抓取并复制了数百万篇拥有版权的新闻报道」,构成「系统性的版权侵权行为」。

法律界分析:斯坦福法学院教授 Mark Lemley 指出,Sony 案裁决为 NYT 提供了「一个全新的法律武器」。如果法院接受 NYT 关于微软「辅助侵权」的主张,那么所有为 AI 训练提供算力的云计算服务商——AWS、Google Cloud、Azure—都将面临类似的潜在责任。这可能导致整个 AI 产业链的结构性重塑。

「Sony 案的关键在于『知道或应当知道』的标准。如果微软在内部文档中讨论过版权问题,却仍然为 OpenAI 提供超级计算机,那这和 Sony 案中为盗版设备提供组件的逻辑就非常接近了。」
— 知识产权律师 Michael Eshaghian,Mesh IP Law

市场影响:消息公布后,微软股价在 6 月 26 日 下跌约 2.3%,反映出投资者对潜在赔偿责任和监管风险的担忧。同时,多家新闻出版集团的股价出现上涨——市场预期如果 NYT 胜诉,新闻内容作为 AI 训练数据的价值将得到法律确认,从而开启内容授权的新商业模式。

五、深度解读:这意味着什么?

AI 版权诉讼的「转折点」

2023 年底 第一批 AI 版权诉讼至今,已过去近 3 年 时间。在这期间,AI 技术飞速发展——GPT-5、Claude 4、Gemini 2.0 相继推出——但核心法律问题仍未解决:在版权法框架下,AI 模型的训练是否构成「合理使用」?

NYT 新诉状的策略性在于:它不再纠缠于抽象的「合理使用」辩论,而是将矛头指向了具体的、可验证的「辅助侵权」行为——超级计算机的建造。这个论据比「模型会复述文章」更具说服力,因为它指向的是一种有意识、有目的的基础设施投资,而非训练过程中不可控的副作用。

对 AI 产业链的潜在冲击

如果 NYT 的诉讼主张被法院接受,影响将远远超出 OpenAI 和微软:

超级计算机的「反讽」

具有讽刺意味的是,微软为 OpenAI 建造超级计算机本身是一个值得称赞的技术成就——它推动了 AI 基础设施的极限,让 GPT 系列模型得以在合理时间内完成训练。然而,这台体现了人类工程学巅峰的超级计算机,如今却成了侵权指控中最关键的「物证」。这正是 AI 时代法律困境的缩影:技术越强大,其潜在的法律风险也越巨大。

六、总结

纽约时报修订诉讼的核心贡献,在于它将 AI 版权问题从一个抽象的「合理使用」争论,转化为一个具体的技术基础设施责任问题。无论最终判决如何,这场诉讼已经永久改变了 AI 行业的风险认知:内容的拥有者和技术的提供者,都必须正视 AI 训练中的数据权利边界。对于整个生成式 AI 行业来说,这或许是比任何技术突破都更具决定性的节点。