OpenAI 训练版权诉讼案新进展:原告指控其隐瞒 LibGen 数据源训练大模型

📡 IT之家2026-09-09 11:38

多位作家在版权诉讼中提交动议,指控OpenAI使用影子图书馆LibGen数据训练模型并刻意隐瞒来源。

AI 深度解读

在 2026 年 9 月初美国作家协会诉 OpenAI 的版权侵权案中,原告向纽约联邦法院提交简易判决动议,指控 OpenAI 在训练早期大模型时曾使用并刻意掩盖 LibGen 盗版图书数据集。

  • 数据集命名与删除指控:原告在动议中指出,OpenAI 曾在 GPT-3 论文中将内部的“Libgen1”和“Libgen2”数据集更名为“Books1”和“Books2”,且因法律风险在 2022 年删除了这批文件,涉案图书达 194 部。
  • 员工言论与替代风险证据:动议援引了 OpenAI 员工在 2025 年发布的公开帖文,其中提及让模型撰写乔治 ·R·R· 马丁《冰与火之歌》续作的研究目标,原告据此论证生成式模型对作家构成了实质性市场替代冲击。
  • 责任认定与合理使用抗辩:原告要求法官直接判定侵权责任成立并不支持合理使用,同时主张主要投资方微软承担连带责任;OpenAI 同日则提出交叉动议,坚持大模型训练属于合理使用范畴。
  • 影响/看点:本案简易判决若支持原告关于训练数据来源非法且不可被目的抗辩的诉求,将可能动摇当前大模型行业普遍依赖的“合理使用”法律基石,迫使 AI 企业全面转向授权采购模式。
  • 资料依据:
  • IT之家(2026-09-09):https://www.ithome.com/1/000/106.htm
  • 美国作家协会 The Authors Guild(2026-09-04):https://authorsguild.org/news/authors-guild-files-motion-for-summary-judgment-in-openai-lawsuit/

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手