一、导语
2026 年 6 月,纽约时报(NYT)在一份经过修订的诉讼文件中扔下一枚重磅炸弹:微软专门为 OpenAI 建造了一台超级计算机,其核心目的之一就是大规模抓取和训练受版权保护的新闻内容。这一指控不仅把 NYT 与 OpenAI 之间持续近三年的版权诉讼推向了新高度,更首次将微软直接定位为「版权侵权基础设施」的建造者——而非仅仅是投资者。
修订后的诉状长达 137 页,其核心论点基于美国最高法院在 2025 年 对 Sony 案的里程碑裁决,重新构建了 NYT 对 OpenAI 和微软的版权侵权主张。与此同时,近 400 家 美国报纸联合在纽约南区联邦法院提起了针对微软和 OpenAI 的集体诉讼——这已不再是 NYT 一家的战斗,而是整个美国新闻行业对 AI 巨头的全面宣战。
二、背景分析:三年诉讼的演变
这场诉讼始于 2023 年 12 月 27 日,当时 NYT 在纽约南区联邦法院正式起诉 OpenAI 和微软,指控其未经授权使用 NYT 的数百万篇受版权保护的新闻文章来训练 GPT 系列大语言模型。这是美国主流新闻机构对 AI 公司提起的首批重大版权诉讼之一,在当时引发了整个科技行业的震动。
诉讼的关键证据是:NYT 展示了一系列「记忆」案例——ChatGPT 能够近乎逐字地复述 NYT 的付费文章内容,证明这些文章确实被纳入了训练数据集,且模型没有能力「忘记」这些受版权保护的文本。
在接下来的 30 个月 中,案件经历了多次关键转折:
- 2024 年 8 月:NYT 提交第一份修订诉状,新增更多侵权证据
- 2025 年 3 月:法院裁定 NYT 的版权侵权指控可以继续审理,驳回 OpenAI 和微软的撤诉动议
- 2025 年:最高法院在 Sony 案中作出重要裁决,重新定义了「辅助侵权」的法律标准
- 2026 年 4 月:本案与其他多起针对 OpenAI 的版权诉讼合并审理
- 2026 年 6 月:NYT 提交第二份修订诉状,首次明确指控微软「建造超级计算机协助侵权」
三、核心内容:超级计算机的指控
修订诉状中最引人注目的指控,涉及微软为 OpenAI 建造的 Azure AI 超级计算机集群。NYT 声称,这台超级计算机的建设不仅仅是技术合作——微软明知 OpenAI 的训练过程涉及大规模版权侵权,仍主动为其提供算力支持。
超级计算机的规模
根据公开信息和诉讼披露,微软为 OpenAI 建造的超级计算机集群包括:
- 数十万 块 NVIDIA GPU(包括 A100、H100 和 B200 系列)
- 遍布全球 数十个 数据中心的分布式训练架构
- 专为 OpenAI 设计的定制化 InfiniBand 网络架构
- 预估建设成本超过 100 亿美元
法律论据的更新
NYT 修订诉状的关键法律创新在于:它不再仅仅指控 OpenAI 和微软「使用了」NYT 的内容进行训练,而是运用最高法院在 Sony 案中的裁决,主张当明知内容被用于侵权用途时,为其提供「实质性帮助」同样构成侵权。具体来说:
- 辅助侵权(Contributory Infringement):微软知道 OpenAI 的训练过程涉及大量受版权保护的内容,却主动提供超级计算机和 Azure 算力
- 替代责任(Vicarious Liability):微软与 OpenAI 签署了排他性云计算协议,从 OpenAI 的运营中获得直接经济利益
- 故意无视(Willful Blindness):微软知道或应当知道其算力被用于侵权训练,却选择不采取任何监督或限制措施
「微软不能一边从 OpenAI 的成功中获取数十亿美元的回报,一边声称对 OpenAI 使用其超级计算机进行侵权训练的行为毫不知情。」
四、各方反应
微软和 OpenAI 的回应:微软发言人在声明中表示,NYT 的新指控「没有法律依据」,强调 AI 训练属于「合理使用」(fair use)范畴,类似于搜索引擎对网页内容的索引。OpenAI 则重申其训练数据收集政策的合法性,并表示已与多家新闻机构签署了授权协议。
400 家报纸的联合起诉:就在 NYT 修订诉状提交的同一天,近 400 家 美国地方报纸通过其母公司向同一法院提起了集体诉讼。这些报纸包括《芝加哥论坛报》《丹佛邮报》《奥兰多哨兵报》等,代表了美国最大的报业集团之一 Tribune Publishing(现为 MediaNews 的一部分)旗下全部报纸。原告律师称,被告「未经授权抓取并复制了数百万篇拥有版权的新闻报道」,构成「系统性的版权侵权行为」。
法律界分析:斯坦福法学院教授 Mark Lemley 指出,Sony 案裁决为 NYT 提供了「一个全新的法律武器」。如果法院接受 NYT 关于微软「辅助侵权」的主张,那么所有为 AI 训练提供算力的云计算服务商——AWS、Google Cloud、Azure—都将面临类似的潜在责任。这可能导致整个 AI 产业链的结构性重塑。
「Sony 案的关键在于『知道或应当知道』的标准。如果微软在内部文档中讨论过版权问题,却仍然为 OpenAI 提供超级计算机,那这和 Sony 案中为盗版设备提供组件的逻辑就非常接近了。」
市场影响:消息公布后,微软股价在 6 月 26 日 下跌约 2.3%,反映出投资者对潜在赔偿责任和监管风险的担忧。同时,多家新闻出版集团的股价出现上涨——市场预期如果 NYT 胜诉,新闻内容作为 AI 训练数据的价值将得到法律确认,从而开启内容授权的新商业模式。
五、深度解读:这意味着什么?
AI 版权诉讼的「转折点」
从 2023 年底 第一批 AI 版权诉讼至今,已过去近 3 年 时间。在这期间,AI 技术飞速发展——GPT-5、Claude 4、Gemini 2.0 相继推出——但核心法律问题仍未解决:在版权法框架下,AI 模型的训练是否构成「合理使用」?
NYT 新诉状的策略性在于:它不再纠缠于抽象的「合理使用」辩论,而是将矛头指向了具体的、可验证的「辅助侵权」行为——超级计算机的建造。这个论据比「模型会复述文章」更具说服力,因为它指向的是一种有意识、有目的的基础设施投资,而非训练过程中不可控的副作用。
对 AI 产业链的潜在冲击
如果 NYT 的诉讼主张被法院接受,影响将远远超出 OpenAI 和微软:
- 云计算厂商:AWS、Google Cloud、Azure 等可能被要求对其 AI 客户的训练数据来源进行合规审查
- 开源模型社区:Hugging Face、GitHub 等平台可能面临「托管侵权模型」的连带责任风险
- AI 公司融资:投资者将更加关注 AI 公司的训练数据合规性,版权风险将成为尽职调查的核心项目
- 内容授权市场:如果 AI 训练需要明确的版权授权,一个全新的内容授权市场可能由此诞生——音乐行业在 Napster 之后经历的转型,可能在新闻行业重演
超级计算机的「反讽」
具有讽刺意味的是,微软为 OpenAI 建造超级计算机本身是一个值得称赞的技术成就——它推动了 AI 基础设施的极限,让 GPT 系列模型得以在合理时间内完成训练。然而,这台体现了人类工程学巅峰的超级计算机,如今却成了侵权指控中最关键的「物证」。这正是 AI 时代法律困境的缩影:技术越强大,其潜在的法律风险也越巨大。
六、总结
纽约时报修订诉讼的核心贡献,在于它将 AI 版权问题从一个抽象的「合理使用」争论,转化为一个具体的技术基础设施责任问题。无论最终判决如何,这场诉讼已经永久改变了 AI 行业的风险认知:内容的拥有者和技术的提供者,都必须正视 AI 训练中的数据权利边界。对于整个生成式 AI 行业来说,这或许是比任何技术突破都更具决定性的节点。