头版Folia Daily Briefing
← 返回头版
科技人工智能

Anthropic被罚15亿美元,AI数据合规标准划分明确

美国加州北区联邦法院正式批准作家群体诉Anthropic的集体诉讼和解方案,和解金额达15亿美元 [1]。法官William Alsup在2025年6月23日的简易判决中明确划分了AI训练数据的两种获取方式:购买正版书籍仅用于模型训练被界定为"合理使用",而批量爬取盗版内容并永久存档则构成侵权行为 [1]。这一判决为全球AI企业敲响了警钟,标志着数据合规的分界线已正式确立。

法院对Anthropic设置了三条强制性要求:永久关停盗版素材数据库、保留完整的数据获取凭证以及接受第三方溯源审计 [1]。该案件带来的影响已波及全球范围,截至2026年5月,全球在审的AI版权相关诉讼共计112起,其中近八成集中在美国 [1]。国内AI版权案件在2026年暴涨216%,其中41%的纠纷与Anthropic案件性质相同 [1],反映出数据合规问题已成为业界共同的法律风险。

合规数据市场规模快速扩张。中国合规中文语料市场规模在2025年达到32.6亿元,同比增速超过40% [1];海外头部大模型合规数据授权成本已占总研发投入的35%,预计2026年末将上升至45% [1]。2026年5月,由中国大百科全书出版社等22家权威单位联合签署了《人工智能高质量语料库建设公约》[1],进一步推动了行业的规范化发展。


AnthropicAI版权诉讼训练数据合规15亿美元和解数据溯源