AI巨头们正在秘密“焚书”?揭秘Anthropic的“巴拿马计划”
社交媒体平台X(原Twitter)近日因一则报道成为重大争议的焦点:据称,人工智能公司Anthropic正在购买数百万册书籍,将其数字化,随后销毁实体书。 这种激进的数据获取策略被人们比作弗诺·文奇2004年的科幻小说《彩虹尽头》,从而引发了关于人工智能公司如何获取训练数据的激烈公众辩论。

“巴拿马计划”曝光:从盗版到合规
2026年初的法庭文件显示,Anthropic曾秘密执行“巴拿马计划”,旨在获取“全世界的所有书籍”。为此,该公司招募了前谷歌图书高管,并投入巨资从二手书商和实体书店大量收购书籍。
这一过程令人触目惊心:员工将实体书运往仓库,在那里通过移除书脊进行“破坏性扫描”,以生成高分辨率PDF文件。剩余的纸张废料随后被送往回收设施。 尽管此举引发了伦理争议,但Anthropic公司援引“首次销售原则”和“合理使用”原则为其行为辩护。该公司辩称,由于其合法购得这些书籍,且仅将扫描件用于内部培训而不进行再分发,销毁原件可有效防止受版权保护的材料出现任何未经授权的二次流通。
15亿美元的法律成本:一种新的版权辩护策略
“巴拿马项目”的曝光并非偶然。Anthropic此前曾面临作者的诉讼,指控其从盗版网站LibGen获取数据。该公司首席执行官承认,与出版商逐一协商许可协议在商业和操作层面都存在困难。
为降低法律风险,Anthropic于2025年支付了约1.5亿美元,以和解涉及其早期数据集的集体诉讼。 此后,该公司转向了“巴拿马项目”——一种成本更高但法律风险更小的模式,即通过收购实体书籍获取数据。当前的司法趋势表明,这种“合法购买+扫描用于训练”的方法提供了强有力的法律辩护依据。
区分事实与虚构:“文化灾难”的迷思
尽管网络舆论将此事称为“蒸馏人类知识”或“古籍的灾难”,但现实远没有那么极端。调查显示,被销毁的书籍大多是市场上随处可见的普通二手书,而非稀有的古籍或文化遗产。主要的批评者是声称受到版权侵权的作者和出版协会,而非文化机构。
美国法律界尚未就人工智能训练是否构成“合理使用”达成最终共识。 与此同时,Meta和OpenAI等其他科技巨头也正面临类似的法律挑战。尽管Anthropic将数百万本实体书转化为“数字数据”的方法成功生成了高质量的训练集,但这种做法所涉及的道德影响和法律边界,仍是人工智能行业面临的关键问题。
相关文章
字节跳动旗下 Seed 启动全球校园招聘,以虚拟股份争夺顶尖大模型人才
在大型语言模型的竞争格局中,争夺顶尖人才仍然是最关键的战略资产。4月1日,字节跳动宣布启动Seed全球校园招聘计划,作为其大模型人才培养项目的一部分。该活动面向2027届毕业生及现有实习生,旨在全球范围内发掘并锁定AI领域的精英研发与工程人才。规模扩张:全球甄选100名“AI种子”在技术快速进步的背景下,字节跳动有限公司今年大幅增加了对基础AI人才的投入:招聘范围: 该计划旨在从全球范围内招聘约100名专注于大模型的杰出候选人,对象为2027届毕业生。发展路径: Seed计划将核心业务
Suno 在法律诉讼中为歌曲添加水印
Suno,这个允许用户生成由人工智能创作的音乐的平台,近日推出了新功能,包括为平台制作的曲目添加标签、限制下载,并更新社区标准以遏制未经授权的复制品。这些更新是在Suno面临多家唱片公司和艺术家组织提起的多起诉讼之际推出的。在博客文章中,联合创始人兼首席执行官Mikey Shulman概述了核心原则,强调该平台旨在促进原创创作,同时扩大更广泛受众对人工智能音乐工具的访问权限。一个主要的争议点在于,用户将人工智能生成的歌曲上传到其他流媒体服务并通过操纵系统获取收入。Suno表示,现在将采用音频
马斯克承认 Grok 构建过程中泄露了用户代码,并承诺清除所有历史数据
埃隆·马斯克直接回应了围绕 Grok Build 的隐私争议,首先以简单的“True”(属实)确认了该事件的有效性。他承诺,此前上传至 SpaceXAI 的所有用户数据将被永久删除,并表示“不留一个字节”。这是人工智能行业首次由主要科技领袖公开承认错误并主动删除用户数据。安全研究人员的“钓鱼”测试揭示了数据泄露的具体证据此次争议源于独立人工智能安全研究人员 @cereblab 的一份报告。SpaceXAI 推出的 AI 编程助手 Grok Build 在其官方网站上声称其“优先本地运行,代码
相关专题推荐
评论 (1)
0/500
社交媒体平台X(原Twitter)近日因一则报道成为重大争议的焦点:据称,人工智能公司Anthropic正在购买数百万册书籍,将其数字化,随后销毁实体书。 这种激进的数据获取策略被人们比作弗诺·文奇2004年的科幻小说《彩虹尽头》,从而引发了关于人工智能公司如何获取训练数据的激烈公众辩论。

“巴拿马计划”曝光:从盗版到合规
2026年初的法庭文件显示,Anthropic曾秘密执行“巴拿马计划”,旨在获取“全世界的所有书籍”。为此,该公司招募了前谷歌图书高管,并投入巨资从二手书商和实体书店大量收购书籍。
这一过程令人触目惊心:员工将实体书运往仓库,在那里通过移除书脊进行“破坏性扫描”,以生成高分辨率PDF文件。剩余的纸张废料随后被送往回收设施。 尽管此举引发了伦理争议,但Anthropic公司援引“首次销售原则”和“合理使用”原则为其行为辩护。该公司辩称,由于其合法购得这些书籍,且仅将扫描件用于内部培训而不进行再分发,销毁原件可有效防止受版权保护的材料出现任何未经授权的二次流通。
15亿美元的法律成本:一种新的版权辩护策略
“巴拿马项目”的曝光并非偶然。Anthropic此前曾面临作者的诉讼,指控其从盗版网站LibGen获取数据。该公司首席执行官承认,与出版商逐一协商许可协议在商业和操作层面都存在困难。
为降低法律风险,Anthropic于2025年支付了约1.5亿美元,以和解涉及其早期数据集的集体诉讼。 此后,该公司转向了“巴拿马项目”——一种成本更高但法律风险更小的模式,即通过收购实体书籍获取数据。当前的司法趋势表明,这种“合法购买+扫描用于训练”的方法提供了强有力的法律辩护依据。
区分事实与虚构:“文化灾难”的迷思
尽管网络舆论将此事称为“蒸馏人类知识”或“古籍的灾难”,但现实远没有那么极端。调查显示,被销毁的书籍大多是市场上随处可见的普通二手书,而非稀有的古籍或文化遗产。主要的批评者是声称受到版权侵权的作者和出版协会,而非文化机构。
美国法律界尚未就人工智能训练是否构成“合理使用”达成最终共识。 与此同时,Meta和OpenAI等其他科技巨头也正面临类似的法律挑战。尽管Anthropic将数百万本实体书转化为“数字数据”的方法成功生成了高质量的训练集,但这种做法所涉及的道德影响和法律边界,仍是人工智能行业面临的关键问题。
字节跳动旗下 Seed 启动全球校园招聘,以虚拟股份争夺顶尖大模型人才
在大型语言模型的竞争格局中,争夺顶尖人才仍然是最关键的战略资产。4月1日,字节跳动宣布启动Seed全球校园招聘计划,作为其大模型人才培养项目的一部分。该活动面向2027届毕业生及现有实习生,旨在全球范围内发掘并锁定AI领域的精英研发与工程人才。规模扩张:全球甄选100名“AI种子”在技术快速进步的背景下,字节跳动有限公司今年大幅增加了对基础AI人才的投入:招聘范围: 该计划旨在从全球范围内招聘约100名专注于大模型的杰出候选人,对象为2027届毕业生。发展路径: Seed计划将核心业务
Suno 在法律诉讼中为歌曲添加水印
Suno,这个允许用户生成由人工智能创作的音乐的平台,近日推出了新功能,包括为平台制作的曲目添加标签、限制下载,并更新社区标准以遏制未经授权的复制品。这些更新是在Suno面临多家唱片公司和艺术家组织提起的多起诉讼之际推出的。在博客文章中,联合创始人兼首席执行官Mikey Shulman概述了核心原则,强调该平台旨在促进原创创作,同时扩大更广泛受众对人工智能音乐工具的访问权限。一个主要的争议点在于,用户将人工智能生成的歌曲上传到其他流媒体服务并通过操纵系统获取收入。Suno表示,现在将采用音频
马斯克承认 Grok 构建过程中泄露了用户代码,并承诺清除所有历史数据
埃隆·马斯克直接回应了围绕 Grok Build 的隐私争议,首先以简单的“True”(属实)确认了该事件的有效性。他承诺,此前上传至 SpaceXAI 的所有用户数据将被永久删除,并表示“不留一个字节”。这是人工智能行业首次由主要科技领袖公开承认错误并主动删除用户数据。安全研究人员的“钓鱼”测试揭示了数据泄露的具体证据此次争议源于独立人工智能安全研究人员 @cereblab 的一份报告。SpaceXAI 推出的 AI 编程助手 Grok Build 在其官方网站上声称其“优先本地运行,代码





首页






