近日,美国旧金山联邦法院正式批准了一项金额创纪录的版权纠纷和解方案——AI领域明星企业Anthropic,因其“数据搬运”行为,需向被侵权的图书作者们支付总计高达15亿美元的赔偿。这笔巨额款项并非小数目。事件的起因,是该公司早年从部分非法来源的数据库中,批量抓取了大量未经授权的图书内容,并直接用于训练自家的AI大模型。简而言之,就是“盗取图书”来喂养AI系统。
根据法院披露的和解文件,涉案作品数量接近48万部,其中绝大多数已完成作者身份确认。每部作品的赔偿标准约为3000美元。除此之外,Anthropic还必须彻底清除所有非法获取的盗版图书数据,不留任何痕迹。
打击盗版数据路径,但确认AI训练合法性
尽管赔偿金额如此之高,法律界普遍认为,此次判决对AI行业而言,实际上是一个重要的积极信号。主审法官在裁定中特别强调:通过合法渠道获取的图书资料用于训练AI模型,完全符合美国版权法中的“合理使用”原则。技术进步的社会价值与应用潜力,这一点毋庸置疑。
换言之,本次追责针对的是“非法获取数据”这一行为本身,而非AI训练这件事。作者们虽然保留了后续起诉的权利——例如指控AI生成的内容侵权,或者Anthropic后续存在其他不当行为——但“合理使用”这一司法确认,等于为整个AI行业卸下了一副关键的法律枷锁。过去那种“到底能不能用公开数据训练模型”的悬疑感,终于有了一个清晰的答案。
