Note: This page does not support English, using the default language version
7月20日,美国加州北区联邦法院正式批准了Anthropic与作家团体的15亿美元版权和解协议。这场持续两年多的版权拉锯战,终于以AI公司掏出真金白银告终。50万部作品,每部约3000美元——听起来数字很大,但这件事的真相,比数字本身更值得玩味。
事情要从2024年说起。一群作家联合起诉Anthropic,指控其在训练Claude时,从Library Genesis、Pirate Library Mirror等盗版网站下载了数百万本图书。原告律师后来澄清,涉及的实际作品约50万部。
Anthropic的辩护逻辑很简单:AI训练本质上是对人类知识的”阅读”,就像人类读书学习一样,不应该算侵权。但法院不这么认为——当你的模型能完整复述某本书的章节时,“学习”和”复制”的边界就模糊了。
最终双方达成和解:15亿美元,销毁含盗版材料的数据集,建立版权审查流程,允许作者申请移除作品。
每部作品3000美元,看着不少,但这是有前提的——
首先,这15亿美元不是立刻全部发放的。和解协议规定的是”至少”15亿美元,实际金额要看最终索赔数量。更关键的是,即便拿到3000美元,对于一位花了两年写出一本专业书籍的作者来说,这点赔偿够吗?一本书的写作成本(时间、脑力、调研)远不止这个数字,而模型学到的,是作者几年积累的认知结晶。
其次,这件事在美国成了判例,不代表中国也有同样的保护。中国作者的作品被喂给了AI,目前并没有明确的法律路径来追讨。 Anthropic赔的是美国作家,国产大模型厂商用的那些中文语料——谁来买单?
我愿意把这个和解称为”里程碑”,原因是它第一次用真金白银回答了一个根本问题:AI公司不能以”学习”为名无偿使用人类创造成果。这打破了之前AI行业普遍存在的”数据白嫖”逻辑——至少在美国是这样。
但它的局限性也很明显:
第一,每部3000美元远不足以弥补创作者的实质损失。 真正的损害是永久性的——模型”学会”了这些知识,以后每次回答都可能是对原作的复现或变体,这不是一次性能赔偿覆盖的。
第二,和解不等于承认侵权,也不构成约束性先例。 Anthropic选择和解,不是因为它认为自己错了,而是诉讼成本和声誉风险太高。其他AI公司完全可以继续白嫖,直到被起诉为止。
第三,中国的创作者保护,目前仍是一片空白。 国产大模型在崛起,但它们的训练数据来源是否干净、是否经过了版权审查,没有任何人知道。如果哪天中国作家也想维权,适用的法律在哪里?
这件事最让我感慨的,不是15亿美元这个数字,而是它撕开了AI行业一块遮羞布——过去几年,整个AI行业都在用”AI在学习”来模糊”AI在复制”的本质。现在,这个借口不好使了。
但我更想说的是:这件事对中国独立博主和中国AI行业,都有深远的启示。
对创作者而言,这是第一次有人告诉你:你的文字是有价的,而且价格可以被法院裁定。对中国AI行业而言,这是一个信号——训练数据的”免费午餐”不会永远吃下去,合规成本只会越来越高。
国产大模型厂商,早点准备吧。
Loading comments...