Anthropic 15 亿美元版权和解金进入发放:作者与出版社围绕 AI 训练赔偿分配起争议
据 IT之家 9 月 7 日消息,Anthropic 去年就一起 AI 训练相关版权集体诉讼达成和解,涉及其在训练模型时使用近 50 万部盗版作品的问题。法院此前认定,使用受版权保护材料训练 AI 模型本身符合“合理使用”原则,但通过盗版渠道获取这些材料并不受合理使用保护。按照和解安排,Anthropic 将为每部涉案盗版作品向原作者支付 3,000 美元补偿,整体和解金规模达到 15 亿美元;该方案已在今年 7 月获得最终批准,并开始进入赔偿金发放流程。
和解规则看似清晰,执行中却出现多方申领
根据和解协议,赔偿金如何分配取决于作品当前的出版与版权状态。若相关图书仍由传统出版社出版,作者与出版社各获得 50%;如果图书为作者自行出版,或出版社此前已让作品绝版并将版权返还给作者,则该作品对应的 3,000 美元赔偿应全部归作者所有。
争议也正出现在这一执行环节。来源显示,近期有作者在社交媒体上表示,部分出版社似乎正在申领超过其应得比例的赔偿。悬疑及惊悚小说作家 April Henry 公开质疑 HarperCollins,称该出版社申领了她一本至少 17 年前已经返还版权的作品赔偿;她还称,自己的信用记录中同日突然出现 HarperCollins 被添加为“雇主”的信息,而她从未为该公司工作。
作家维权博客 Writers Beware 的作者 Victoria Strauss 表示,近期收到的投诉大致集中在两类情况:一是出版社对已经不再拥有合法版权的作品提出申领;二是出版社向 Anthropic 申领了 100% 赔偿,但按协议原本只能获得 50%。不过她也认为,这类问题通常更可能来自版权记录管理混乱和大规模和解流程复杂,而不一定是出版社有意“抢钱”。据称,一些出版社已经承认相关申领存在错误,并表示正要求 Anthropic 修正。
- 赔偿对象:近 50 万部被盗版获取并用于训练的作品原作者。
- 补偿标准:每部涉案作品 3,000 美元。
- 分配原则:在版传统出版作品作者与出版社各半;自出版或版权已返还作品归作者。
- 争议焦点:出版社、文学经纪机构与作者之间的申领资格和比例。
对 AI 行业的影响:训练数据合规不止是“能不能用”
这起事件的关键不只是赔多少钱,而是进一步厘清了 AI 模型训练中的两层合规问题:其一,受版权保护内容用于模型训练是否构成合理使用;其二,训练数据的获取路径是否合法。法院在该案中的判断显示,“使用”与“获取”可能被分开审视。这对 AI 公司、数据供应商和内容平台都具有现实意义:即便训练行为本身获得一定法律空间,数据来源仍可能成为高风险环节。
从产业角度看,15 亿美元级别的和解也会成为内容方与 AI 公司谈判的重要参照。大型模型公司未来若希望降低诉讼风险,可能更重视授权采购、数据溯源、版权元数据管理以及与出版机构建立更清晰的合作机制。与此同时,作者个人、出版社和文学经纪机构之间的权利边界,也会因为 AI 训练赔偿而被重新审视。
大规模版权清算考验执行系统
目前,围绕 Anthropic 和解金的争议仍在持续。除出版社外,Strauss 还提到收到关于文学经纪机构提出赔偿申领的投诉。这说明在 AI 训练数据的版权清算中,真正困难的部分未必只是判定责任,还包括如何准确识别权利人、核验版权状态并完成分配。
对于中文读者和国内 AI 从业者而言,这一案例值得关注:随着模型训练进入更强监管和更高商业化阶段,版权问题会从原则性讨论转向细颗粒度执行。Anthropic 的和解金发放争议表明,AI 时代的版权治理不仅需要法律裁定,也需要可信的数据记录、透明的申领流程和可纠错的分配机制。否则,即便和解已经落地,围绕补偿资格与收益分配的摩擦仍可能持续放大。