美国司法部表态支持 OpenAI:用版权文本训练 LLM 应属合理使用
事件背景
围绕《纽约时报》2023 年 12 月起诉 OpenAI 和 Microsoft 的版权案,特朗普政府于 9 月 1 日向曼哈顿联邦法院提交了一份 20 页的利益声明(Statement of Interest),正式主张用受版权文本训练大语言模型通常构成合理使用。这是华盛顿首次介入 AI 训练版权诉讼潮。简报援引特朗普此前签署的行政命令,称限制 LLM 发展将阻碍创新与美国繁荣。
司法部的论证框架
| 环节 | 司法部立场 |
|---|---|
| 数据获取 | 未表态支持——作为独立问题留给法院逐案判断 |
| 模型训练 | 具有「非凡转换性」,不同于发表文章、不会替代原作,通常构成合理使用 |
| 模型输出 | 是否与原作构成实质性相似,需逐案裁定 |
司法部同时以国家安全为由警告:一刀切的许可要求会抬高小公司门槛、削弱美国 AI 开发者的竞争力。
各方的位置
- 《纽约时报》:发言人批评政府站在 AI 公司一边、牺牲创作者权益。
- 法院:该意见书仅具咨询性、对法院无约束力;法官已要求双方最迟 9 月 4 日提交简易判决动议。
- 业界:若法院采纳该框架,法律压力将从「训练是否合法」转向「数据怎么来的」和「输出抄没抄」两个具体环节。
时间线要点
- 9 月 2 日 16:31:The Verge 报道特朗普政府提交利益声明支持 OpenAI。
- 17:08-17:39:Rohan Paul 两度解析意见书要点:训练转换性、三环节区分、咨询性质。
- 18:32:The Decoder 确认司法部主张训练复制与模型输出之间存在法律区分。
- 9 月 3 日 00:29:IT之家报道法院要求双方 9 月 4 日前提交简易判决动议。
编辑部的看法
该案可能为 AI 训练版权合法性确立先例。对中国出海的 AI 团队,值得注意的不是立场本身,而是框架:即便「训练=合理使用」成为主流叙事,数据获取合规与输出相似性仍是两条独立的红线——训练数据的授权链条和输出的查重机制,一个都不能省。
数据来源与原文出处
数据来源:AIHOT(热点聚合时间线)
- The Verge:特朗普政府在纽约时报诉 OpenAI 版权案中提交声明支持 OpenAI
- TechCrunch:美国政府就版权材料训练 LLM 争议表态支持 OpenAI
- The Decoder:美国司法部在纽约时报版权案中支持 AI 训练属合理使用
- Rohan Paul:意见书框架解析 / 转换性论证推文
- IT之家:美国司法部介入纽约时报诉 OpenAI 案,主张 AI 训练属合理使用
—— 完 ——