Anthropic 高喊人类命运,却可能毁掉全球唯一孤本

一段纠缠近两年的AI版权诉讼,终于在2025年7月20日画上了一个震撼业界的句点。Anthropic,这家以负责任AI和安全自居的明星公司,被法院裁定支付高达15亿美元的和解金,以了结其使用盗版书籍训练大模型的集体诉讼。

这个数字有多直观?据路透社报道,Anthropic在2023至2025这两年的实际营收也不过50亿美元。一刀下去,几乎砍到了大动脉。作为首个因训练数据版权问题被重罚的头部AI公司,这笔罚款显然有着“杀一儆百”的意味。

但翻阅判决书后会发现,真正让这起案件变得戏剧化的,是Anthropic自己递出的刀。

一切始于2021年的一篇论文。Anthropic在阐述早期模型训练数据时,提到了一个名为“The Pile”的数据集,其中包含一个几乎被所有大模型“用过”的、包含近20万本未授权电子书的子集——“Books3”。虽然当时这更多被视为学术灰色地带,但隐患已经埋下。

真正的引爆点出现在2024年。当媒体深入调查企业如何利用The Pile进行模型训练时,Anthropic发言人不得不承认,其商业模型Claude确实使用了包含侵权内容的The Pile。这下,版权方彻底怒了:你拿着我的作品训练出模型,然后用它来抢我的饭碗,而我却一分钱拿不到?

三名作家代表数十万版权方发起了史上最大的AI版权诉讼。随着案件深入,更惊人的内幕被挖出:Anthropic使用的盗版图书远不止Books3里的几十万本,还包括另一个名为“LibGen”的数据库,以及一个内部的“PiLiMi”数据集,总涉及超过700万本未经授权的书籍。

但整起事件中最令人瞠目结舌,偏偏又是唯一合法的操作,是Anthropic为规避版权风险所采取的“物理销毁”策略。

2024年,意识到盗版风险的Anthropic开始大规模采购纸质书籍。这些书在购入后,会被直接“破坏性扫描”:拆掉书脊、切开书页,塞进高速扫描仪。扫描完成后,纸质原件会被立即销毁,而数据库则被严格密封在公司内部,禁止外传。

这一操作完美契合了美国版权法的“首次销售原则”:只要你合法购买了实体副本,之后如何处置(哪怕是用碎纸机)都完全合法。但这背后的商业逻辑远比法律条文更冷酷。相比之下,Google Books在扫描图书时,保留了原始纸质书,并仅提供有限的检索片段,最终同样被法院认定为“合理使用”。而Anthropic为了追求最低的扫描成本和最彻底的版权规避,选择了将书籍物理消灭。

当一家标榜“把人类命运挂在嘴边”的公司,一边呼吁全球放慢AI发展速度,一边却在偷偷销毁实体书籍来喂饱自己的模型,这种“正面一套背面一套”的做法瞬间点燃了舆论。社交媒体上相关话题浏览量超过两千万,二手书商痛心地表示,其中一些被销毁的书籍,或许就是世界上流通的最后几本了。

讽刺的是,正是这个“合法”的操作,在法庭上成了指控Anthropic“明知故犯”的关键证据。既然你如此精通法律路径来规避风险,那么之前下载盗版书的行为就只能是主观恶意的。

最终,法院批准了15亿美元的和解方案。但在这场天价官司里,最大赢家可能不是作者——原告律师团起初要收和解金的20%(整整3亿美元),虽被法院砍到1亿美元,依然是常人难以企及的财富。

这起判决不仅是对Anthropic的敲打,更是为所有仍在进行中的AI版权案打了个样:法院倾向于快速终结争议,让受害者先拿到赔偿。但对于整个行业而言,核心问题并未解决:AI到底能否在不打招呼的情况下,使用创作者的劳动成果进行训练?如果AI生成的内容完美复刻了原作的风格,责任又该算在谁的头上?

比起那些关于超级智能和人类灾难性风险的宏伟蓝图,Anthropic或许应该先把目光拉回当下——看看在这场无人自愿退出的竞赛中,有哪些底线和良知,是真正值得被摸一摸的。

免责声明:本网站内容主要来自原创、合作伙伴供稿和第三方自媒体作者投稿,凡在本网站出现的信息,均仅供参考。本网站将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。本网站对有关资料所引致的错误、不确或遗漏,概不负任何法律责任。任何单位或个人认为本网站中的网页或链接内容可能涉嫌侵犯其知识产权或存在不实内容时,可联系本站进行二次审核删除:fireflyrqh@163.com。
Like (0)
Previous 2026年7月30日 上午12:56
Next 2026年7月30日 上午3:25

相关推荐