美国司法部表态支持 OpenAI:用版权文本训练 LLM 应属合理使用

精益前沿编辑部编辑于 2026-09-04
185 次阅读

事件背景

围绕《纽约时报》2023 年 12 月起诉 OpenAI 和 Microsoft 的版权案,特朗普政府于 9 月 1 日向曼哈顿联邦法院提交了一份 20 页的利益声明(Statement of Interest),正式主张用受版权文本训练大语言模型通常构成合理使用。这是华盛顿首次介入 AI 训练版权诉讼潮。简报援引特朗普此前签署的行政命令,称限制 LLM 发展将阻碍创新与美国繁荣。

司法部的论证框架

环节司法部立场
数据获取未表态支持——作为独立问题留给法院逐案判断
模型训练具有「非凡转换性」,不同于发表文章、不会替代原作,通常构成合理使用
模型输出是否与原作构成实质性相似,需逐案裁定

司法部同时以国家安全为由警告:一刀切的许可要求会抬高小公司门槛、削弱美国 AI 开发者的竞争力。

各方的位置

  • 《纽约时报》:发言人批评政府站在 AI 公司一边、牺牲创作者权益。
  • 法院:该意见书仅具咨询性、对法院无约束力;法官已要求双方最迟 9 月 4 日提交简易判决动议。
  • 业界:若法院采纳该框架,法律压力将从「训练是否合法」转向「数据怎么来的」和「输出抄没抄」两个具体环节。

时间线要点

  • 9 月 2 日 16:31:The Verge 报道特朗普政府提交利益声明支持 OpenAI。
  • 17:08-17:39:Rohan Paul 两度解析意见书要点:训练转换性、三环节区分、咨询性质。
  • 18:32:The Decoder 确认司法部主张训练复制与模型输出之间存在法律区分。
  • 9 月 3 日 00:29:IT之家报道法院要求双方 9 月 4 日前提交简易判决动议。

编辑部的看法

该案可能为 AI 训练版权合法性确立先例。对中国出海的 AI 团队,值得注意的不是立场本身,而是框架:即便「训练=合理使用」成为主流叙事,数据获取合规与输出相似性仍是两条独立的红线——训练数据的授权链条和输出的查重机制,一个都不能省。

数据来源与原文出处

数据来源:AIHOT(热点聚合时间线)

—— 完 ——