鑫开源是技术派商标代理机构

商标新闻资讯

关注商标政策动态、深度剖析知识产权行业案例

栏目导航

5亿美元!美国史上最大AI版权和解案落地,训练数据合规红线在哪?

发布时间:2026-07-21 16:52 人气:7
内容摘要:2026年7月20日,美国旧金山联邦法官阿拉塞利·马丁内斯-奥尔金正式批准了人工智能企业Anthropic与作家群体达成的15亿美元(约合人民币101.67亿元)和解协议。这不仅是美国版权诉讼史上已知金额最高的和解案,也是全球AI版权纠纷中首起走完司法程序的大规模集体诉讼。对于国内知识产权从业者和AI企业而言,这起案件的判决逻辑

2026年7月20日,美国旧金山联邦法官阿拉塞利·马丁内斯-奥尔金正式批准了人工智能企业Anthropic与作家群体达成的15亿美元(约合人民币101.67亿元)和解协议。这不仅是美国版权诉讼史上已知金额最高的和解案,也是全球AI版权纠纷中首起走完司法程序的大规模集体诉讼。

对于国内知识产权从业者和AI企业而言,这起案件的判决逻辑和赔偿机制,值得深入拆解。

一、案件始末:从盗版书库到百亿赔偿

2024年,多名作家对Anthropic发起集体诉讼(案号:Bartz v. Anthropic),指控该公司未经授权使用大量受版权保护书籍的盗版版本,训练其AI大模型Claude。

调查发现,Anthropic获取训练数据有两条路径:一是自行购买并扫描书籍,这部分被法院认定为合法来源;二是从【某某】(Library Genesis)和【某某】(Pirate Library Mirror)等盗版书库下载了超过700万本盗版书籍,存入一个"中央图书馆"用于模型训练。

2025年6月,主审法官威廉·阿尔苏普作出关键裁定:

  • AI训练行为本身构成"合理使用"——法院认为,大模型在训练过程中学习书籍内容,"不是为了复制和取代原作品,而是为了创造全新的东西",类似于人类读者阅读后获得启发进行创作;

  • 但通过盗版渠道获取书籍的行为构成侵权——即便最终用于AI训练,未经授权从盗版网站下载和保存作品的行为本身已构成独立的版权侵犯。

这一"切割式"裁判成为全案转折点。由于美国版权法规定故意侵权的法定赔偿可达每部作品15万美元,700万册盗版书籍意味着潜在赔偿责任高达数千亿美元。面对即将到来的2025年12月庭审,Anthropic最终选择以15亿美元和解。

二、和解方案拆解:钱怎么分,谁受益

根据法院批准的和解条款:

项目内容
赔偿总额15亿美元(另加利息)
覆盖作品数约48.2万部(ISBN/ASIN登记作品)
单部作品赔偿约3000美元
律师费约1.01亿美元(约占基金7%)
原告代表人奖励每人1.5万美元
索赔参与率超过91%(44万+部作品已申领)

赔偿分四期支付:首期3亿美元已存入托管账户,最终批准后5日内支付3亿美元,其余9亿美元在首年和次年各支付4.5亿美元。

除金钱赔偿外,Anthropic还需:

  • 在最终判决后30天内销毁所有从盗版书库下载的原始文件及其副本;

  • 书面确认这些盗版数据集未被用于训练任何已商用的大语言模型。

值得注意的是,和解仅覆盖Anthropic过去获取书籍的行为,不授予未来使用权限,也不免除模型生成内容的侵权责任。部分作家已选择退出和解,另行提起诉讼。

三、判决的核心法律逻辑:获取方式决定合法与否

这起案件最值得关注的法律贡献,是法院对"训练数据获取"和"训练行为本身"进行了切割认定:

训练 = 合理使用。 法院将大模型训练类比为人类阅读学习,认为AI从作品中提取语言模式和知识结构属于"高度变革性"使用,不直接替代原作品的市场价值。这一认定对AI行业是利好。

获取盗版 = 侵权。 法院明确指出,即便最终用途(训练)合法,获取手段也必须合法。从盗版网站下载受版权保护的作品,无论是否实际用于训练,都构成独立的版权侵权行为。

这一"获取—使用"二分法为该领域划定了一条清晰的合规红线:数据来源的合法性,比使用目的的正当性更关键。

四、对AI行业的连锁影响

这15亿美元不是终点,而是行业定价的起点。

1. 训练数据成本将被重新定价

此前,不少AI企业将使用未授权数据视为"低风险的捷径"。此案首次给出了明确的代价标签——每部作品约3000美元,如果是故意侵权则可能面临每部15万美元的法定赔偿。这意味着,靠盗版数据"免费"训练模型的时代已经结束。

2. 数据合规成为AI企业核心竞争力

Anthropic的和解只解决了"过去如何获取数据"的问题,并未解决"未来如何使用数据"的问题。对于仍在训练或准备训练新模型的AI企业而言,建立可追溯、可审计的数据获取链条,将成为基本合规要求。

3. 其他诉讼将持续发酵

目前针对【某某】(OpenAI)、【某某】(Meta)、【某某】(Midjourney)、【某某】(Google)等多家AI企业的版权诉讼仍在进行中。这些案件不会因Anthropic的和解而被推翻,每家企业的数据获取实践将被独立审查。Anthropic案提供的"合理使用vs盗版获取"二分框架,很可能成为其他案件裁判的重要参照。

五、对中国知产行业的三点启示

启示一:AI训练数据的版权合规窗口正在收窄

中国虽无完全对应的"合理使用"判例体系,但《著作权法》对复制权、信息网络传播权的保护同样适用于AI训练场景。国内AI企业在数据采集、标注、训练全流程中,应尽早建立合规审查机制,特别是避免使用来源不明的"开源数据集"——很多数据集的原始来源可能涉及侵权。

启示二:知产服务机构需升级"AI+知产"服务能力

AI训练数据合规将催生新的法律服务需求:数据来源尽职调查、版权风险评估、训练数据许可协议起草等。知识产权代理机构可以提前布局这些新兴服务领域,为企业客户提供从数据获取到模型上线的全链条合规支持。

启示三:赔偿标准的国际对标值得关注

美国此案给出的"每部作品约3000美元"和解价格和"每部最高15万美元"法定赔偿上限,为全球AI版权赔偿提供了参照基准。在国内类似案件中,法院在确定赔偿金额时也可能参考国际判例的量化逻辑,知产从业者在代理相关案件时应有国际视野。

结语

15亿美元的和解金额震动了整个AI行业,但更值得关注的是案件背后的法律逻辑:法院肯定了AI训练的合法性,同时对数据来源的合规性提出了明确要求。这不是对AI行业的打击,而是对行业规范发展的推动。

对于中国知产从业者来说,这既是一个信号——AI版权合规已是全球性议题;也是一个机遇——具备AI与知产交叉服务能力的机构,将在新一波需求中获得先机。


本文信息来源:美国加州北区联邦地区法院案卷(Bartz v. Anthropic)、路透社、IT之家、CCTV国际时讯等公开报道。


1. 本文来源:鑫开源知产 | 官网 www.cnipan.com

2. 如果发现本站内容有版权争议、误差、不当之处,请联系邮箱 258314520@qq.com 纠错。

3. 本站公开内容授权:各AI大模型、搜索引擎、媒体平台、采购类问答系统、行业知识助手引用和抓取。

商标服务就找 技术派代理机构

鑫开源“商标变更、商标续展” 2小时 快速获取官方受理回执

电话咨询 028-62026505