被指在 AI 训练中滥用盗版书籍，Adobe 面临集体诉讼

2025-12-18 发布浏览370次点赞0次收藏0次

12 月 18 日消息，据外媒 TechCrunch 今日报道，一项由作家 Elizabeth Lyon 发起的集体诉讼对 Adobe 发出新的指控，称对方在训练 SlimLM 语言模型时，使用了包括 Lyon 本人的作品在内的大量盗版书籍。Lyon 来自俄勒冈州，长期从事非虚构写作，并出版多本写作指导类书籍。

Adobe 方面介绍，SlimLM 是一套面向移动设备文档辅助场景的小语言模型，其预训练基础为 SlimPajama-627B 数据集。该数据集由 Cerebras 于 2023 年发布，被描述为去重、多语料的开源集合。然而诉讼认为，SlimPajama 本身来源存在问题。

诉讼文件指出，SlimPajama 是在复制并加工 RedPajama 数据集的基础上生成的，而 RedPajama 包含广受争议的 Books3 数据集。Books3 收录约 19.1 万本书籍，其中包含大量受版权保护作品。

诉讼明确指出，作为 RedPajama 的派生数据集，SlimPajama 同样包含 Books3 内容，因此不可避免地纳入了原告及其他作者的版权作品。

围绕 Books3 和 RedPajama 的争议，早已不止于 Adobe。此前，苹果和 Salesforce 均因涉嫌在 AI 训练中使用相关数据集而遭到起诉，相关案件指控企业未经授权使用受版权保护内容。

在更广泛的行业背景下，类似诉讼正在成为常态。AI 模型对训练数据规模的高度依赖，使数据来源问题频频引发法律风险。今年 9 月，Anthropic 同意向多名作者支付 15 亿美元（注：现汇率约合 105.77 亿元人民币），就其训练 Claude 时使用盗版作品的指控达成和解。该案件被外界视为 AI 训练版权争议的重要节点，然而行业内持续扩大的法律挑战仍未终结。

AI版权 AI侵权 AI 苹果 Claude 写作 Adobe

声明：本文转载自IT 之家，转载目的在于传递更多信息，并不代表本社区赞同其观点和对其真实性负责，本文只提供参考并不构成任何建议，若有版权等问题，点击这里查看更多信息！

被指在 AI 训练中滥用盗版书籍，Adobe 面临集体诉讼

aizws = AI 中文社

欢迎来到 AI 中文社区（简称 AI 中文社），这里是学习交流 AI 人工智能技术的中文社区。按下 Ctrl+D 或 ⌘+D 收藏本站。

aizws = AI 中文社

欢迎来到 AI 中文社区（简称 AI 中文社），这里是学习交流 AI 人工智能技术的中文社区。 按下 Ctrl+D 或 ⌘+D 收藏本站。

欢迎来到 AI 中文社区（简称 AI 中文社），这里是学习交流 AI 人工智能技术的中文社区。按下 Ctrl+D 或 ⌘+D 收藏本站。