群发资讯网

它们开始吃纸了。硅谷那帮搞大模型的,终于露出了最原始的獠牙。 最近日本古书界出一

它们开始吃纸了。硅谷那帮搞大模型的,终于露出了最原始的獠牙。
最近日本古书界出一件怪事。从今年8月开始,日本各地的线上旧书店突然涌进大量订单,买家账号五花八门,但收件地址全部指向同一个地方——冈山县的一个物流中心。
 
东京一家旧书店一天卖出一百本,关东有家店累计成交破千册,甚至有店主发现订单间隔几乎一模一样,怀疑对方是用程序在自动下单。
 
这哪是书虫淘书,分明是冲着纸上的字来的。
 
更让人后背发凉的是后续。日本电视台顺着贸易数据一查,一家大型出版经销商的集团公司,从去年开始向美国出口了超过50吨日文书籍,报关品名就叫“JAPANESE BOOKS”。
 
50吨是什么概念?按每本500克粗算,那是十万册书,整箱整箱地运出国门。
 
纸书变“饲料”,互联网已经被吃秃了
 
为什么偏偏是现在?为什么偏偏盯上旧书?
 
道理不复杂,大模型快没东西可吃了。过去几年,AI公司把互联网上的网页、论坛、社交媒体翻了个底朝天,公开文本基本见底。
 
更要命的是,自从AI生成的内容充斥网络之后,模型再吃这些“二手饭”,性能不升反降,业内叫“模型崩溃”。
 
于是那些藏在旧书店角落里、几十年没被数字化过的纸质书,成了眼下最抢手的“纯净粮源”。
 
日本旧书被盯上,还有一层现实逻辑:纸质好、排版规整、OCR识别率高,而且里面藏着大量未被网络污染的逻辑思维和历史细节。
 
哲学、医学、法律、地方志,甚至三十年前的政治小册子,全在扫货清单上。买家的胃口不是挑书,是清仓。
 
50吨只是冰山一角。法庭文件揭开了一个更惊人的真相。
 
一个叫“巴拿马计划”的东西
 
美国作家集体起诉Anthropic的版权案,暴露了这家Claude背后公司的操作路径。
 
诉讼材料显示,Anthropic内部文件里赫然写着“巴拿马计划”的目标——以破坏性方式扫描全世界所有的书。
 
具体手法是这样的:论吨买进实体书,用液压切割机把书脊切掉,送进工业级高速扫描仪,数字化完成后,原书直接进碎纸机。
 
有员工看到过流水线上的书,大量是日文、德文、俄文的旧书,有图书馆淘汰的,有全新没拆封的,还有英国议会的文件。
 
今年7月,Anthropic为盗版书籍训练AI一事付出了15亿美元的代价,涉及约48万部作品。
 
但注意一个细节:法院只重罚了从盗版渠道获取内容的行为,对合法购买正版纸质书再销毁这件事,态度暧昧得多。
 
换句话说,只要你花钱买书、切碎、扫描,法律上的口子就小得多。
 
这才是最要命的地方。日本的出版经销商被卷进来,不是因为违法,而是因为合法。
 
2026年3月期,日贩的取次事业部门录得36亿日元经常赤字,实体书流通的旧模式已经撑不住了。
 
这时候来一个大客户,不问品类、不退货、现金结算,谁能扛住这个诱惑?
 
“买书—切书—喂AI—销毁”,一条完整的产业链已经跑通了。法律没堵上的漏洞,正被商业利益疯狂填充。
 
规则真空里的“数字焚书”
 
真正值得警惕的不是某一家公司的行为,而是这件事背后的规则真空。
 
纸质书的数据版权,在全球范围内几乎是一片无人区。电子书有DRM保护,网络文学有平台维权,但纸质书呢?印出来了,卖出去了,后面发生什么,版权方既看不到也管不着。
 
AI模型是个黑箱,你根本没法查证某本书是否被训练过,侵权痕迹几乎无迹可寻。
 
有出版社开始在版权页印上“禁止用于AI训练”的声明,说实话,态度是好的,但实操层面基本拦不住谁。
 
与此同时,互联网上的优质数据正在枯竭。有研究推测,按现有趋势,公开可用的高质量文本存量将在2026到2032年间被充分利用完毕。数据焦虑驱动的“抢书大战”只会愈演愈烈。今天扫的是日本,明天呢?
 
二手书商说了一句话很扎心:营收增长当然高兴,但书以后的命运会怎样,心情很复杂。这话背后是一种朴素的不安——书是用来读的,不是用来吃的。
 
人类几百年攒下来的纸质文明,如果最后以“算力燃料”的方式退场,那不叫进步。
 
那叫焚书坑儒换了个文明的壳子。技术迭代不能凌驾于文化尊严之上,AI公司想用书,可以,坐下来谈授权、谈分成、谈规则。绕过版权方直接“拆书炼丹”,吃相太难看。