几百万本书被 AI "阅后即焚",背后是个叫"巴拿马"的秘密老周在旧书街开了二十年店,什么客人都见过。可上个月那拨人,还是让他心里咯噔一下。他们不问版本,不挑品相,连书脊裂了、封面掉了的也照单全收。最怪的是不讨价。老周开价,他们点头;老周说"这本没了",他们回一句"那把剩下的全要了"。老周以为碰上了隐姓埋名的收藏家。直到后来他在一篇报道里看到:那些书被一车车拉进库房,书脊先被液压切割机切断,散开的书页送进高速扫描仪,转成高清 PDF。然后,纸被送去了回收厂,碎了。你没听错,这不是小说。据《华盛顿邮报》从四千多页解封的法庭材料里挖出的细节,美国 AI 公司 Anthropic 在 2024 年初,启动了一个内部代号叫"巴拿马计划"(Project Panama)的项目。他们花了几千万美元,买下数百万本纸质书。仅一份项目方案的计划量,就是半年内处理 50 万到 200 万本。而那份内部文件里有两句话,让人脊背发凉:"巴拿马计划,是我们对全世界所有图书进行破坏性扫描的行动。""我们不希望外界知道,我们正在做这件事。"---我做码农快十年,也碰过模型训练。说句大白话:今天你用的那些 AI,本质上是个"啃书长大的学生"。你喂它越多、越好的文字,它就越会说话、越会想。互联网上的帖子、新闻,是它们的"快餐",量大,但水货多、重复多。书才是"细粮",逻辑密、语言干净、知识成体系。研究人员早就在警告一个词,叫"数据墙"。干净的高质量公开文本,按现在 AI 的饭量,几年内就会被啃光。于是 AI 公司盯上了真实世界的书架。他们尤其盯上 2022 年以前出版的书。为什么?因为 2022 年之后,互联网上开始混进大量 AI 自己写的东西。用行话说,这些老书"没被机器污染过",是当下最稀缺、最干净的"高质量资产"。这就解释了开头那一幕。那些冷门、绝版、印量极小的书,地方志、小语种文献、自费出版的回忆录,因为网上根本搜不到电子版,反而成了 AI 眼里的"顶级食材"。它们被买下、切脊、扫描,然后实体被销毁。最让我这个码农心里发毛的,不是"扫描",而是"销毁"。孤本,就是全世界仅存的那一本。它毁了,人类就永远失去了一件摸得着的、实体的记忆。它"活"下来的方式,只剩某个公司服务器里的像素,而且这些像素归谁、谁能看,到现在还没说清楚。想象一下:你爷爷留下的手写日记,被标好价买走、扫描、烧掉。以后你只能在别人家的机器里,按它的规则,看见它。细思极恐。唯一的那本书只剩像素,我们失去的不只是纸,而是"它本可以属于任何人"的可能。更讽刺的是中间商。一家叫 ISBNdb 的公司,公开向 AI 客户兜售"代购纸质书"服务,一次能采购 1000 到 100 万本,货源覆盖旧书店、图书馆和绝版书目录。它还把"保密"做成卖点:签严格的保密协议,客户是谁、买了什么书,一概不公开。连 ISBNdb 自己都承认:"AI 公司销毁两百万本书,可不是什么能赢得同情的新闻标题。"它甚至建议客户,把这事重新包装成"数字化保存"。可图书馆的数字化,是为了保存和传播;AI 公司的数字化,是消耗和训练。扫完的内容锁进私有数据库,公众碰不到。这事在法律上站得住吗?2025 年 6 月,联邦法官威廉·阿尔苏普裁定:只要你合法购买了书,扫描后销毁、只留内部训练用的副本,属于"合理使用"(fair use)。买书合法,偷书(比如从盗版库下载)不行——Anthropic 为此付出了 15 亿美元和解金,这是美国版权案史上最大的一笔。法官的逻辑像在说:你花钱买了这本书,怎么处理是你的自由;但你从盗版网站白嫖,代价就极其昂贵。于是出现了一个荒诞的激励。留着原书,更可能惹上"非法复制"的麻烦;销毁原件,反倒规避了指控。书商越配合销毁,法律风险越低。合法,但难看。我是支持 AI 发展的。它帮我写代码、查资料,是真香。但读到"巴拿马计划"那句"我们不想让人知道",我还是忍不住想骂一句:这简直是 2026 年版本的焚书坑儒。书,是人类传了几千年的东西。从竹简到纸,从手抄到印刷,一代代往下递。到你这一代,倒好,为了喂饱一个模型,把实体的传承一刀切了,只留个电子版锁在自己机房里。AI 发展是好事,这点我认。可好事,不能这么干。你毁掉的不只是纸,是"这本书本来可以一直流传下去"的可能性。那本绝版的地方志、那本小语种的孤本,本来或许还能在谁的书架上待上一百年。现在,它们只存在于某家公司的训练库里,外人连看一眼的资格都没有。看得见的 AI 越来越聪明,看不见的代价,正被一页页撕掉。我们能做的,至少是先知道这事正在发生。如果这篇让你背后一凉,点个「赞」和「在看」,转发给那个爱逛旧书店的朋友。关注「码农老王」,每天用大白话,讲清一个你没注意到的科技暗面。参考文章:[1] 腾讯新闻《数百万本书,被Claude"阅后即焚"》(2026-08-01),梳理 Anthropic"巴拿马计划"法庭材料细节:https://new.qq.com/rain/a/20260801A09S9Q00[2] 新浪财经《AI公司,批量抢购旧书》(2026-08-03),引述 404 Media 对 ISBNdb 代购业务的调查,及"2022年前未被机器污染数据"的动机:https://finance.sina.com.cn/jjxw/2026-08-03/doc-inikyxux2973420.shtml[3] 腾讯新闻《AI公司,批量抢购旧书》(2026-07-31),Anthropic 15亿美元和解案与"合理使用"判决:https://new.qq.com/rain/a/20260731A03D2T00