据路透社报道,美国联邦法院周一正式批准 Anthropic 公司与作家、出版商达成的 15 亿美元集体诉讼和解协议。该协议用于解决 Anthropic 因训练 AI 模型过程中涉嫌侵犯版权引发的诉讼,公司随后将开始向相关版权方支付赔偿。
美国加州北区地方法院法官 Araceli Martinez - Olguin 签署了最终批准文件。此前,已退休法官威廉·阿尔苏普曾初步批准该和解方案,并裁定 Anthropic 曾非法下载并存储数百万本受版权保护的书籍。根据赔偿方案,每部涉案作品预计可获得 3000 美元赔偿,涉及作品数量约 50 万部,赔偿金额将由拥有版权的作者和出版商共同分配。这一金额被认为是美国版权法领域规模最大的和解之一。
不过,该协议并未完全解决围绕 AI 训练数据的法律争议。阿尔苏普法官此前在案件核心问题上支持 Anthropic,认为利用受版权保护文本训练 AI 模型可能属于“合理使用”范畴,被业内视为 AI 版权判例的重要进展。但与此同时,他指出 Anthropic 获取部分训练数据的方式存在违法问题。Anthropic 此前主要通过两种方式获取训练数据:一部分来自合法购买并扫描的书籍,另一部分则来自 Library Genesis、Pirate Library Mirror 等盗版网站下载的内容。法院认为,后者涉及非法获取版权材料。为避免进一步审判以及可能面临的高额赔偿,Anthropic 最终选择达成和解。
业内人士指出,虽然此次和解结束了该案件,但并未形成针对整个 AI 行业的统一法律标准。由于 Anthropic 选择和解,案件未进入上诉程序,阿尔苏普此前关于 AI 训练“合理使用”的判断也不会成为具有约束力的司法先例。目前,围绕 AI 模型训练数据版权问题的诉讼仍在持续,包括针对谷歌、Meta、Midjourney 和 OpenAI 等公司的相关案件。近期,Hachette、Cengage、Elsevier、作家 Scott Turow 以及 SCRIBE 等出版机构和作者还联合起诉谷歌,指控其未经授权使用版权作品训练 Gemini 人工智能平台。
编辑观点:Anthropic 和解虽解决个案,但 AI 训练数据版权问题复杂,统一标准亟待确立,以规范行业发展,平衡创新与版权保护。