人类几千年文明积累的智慧,正在以一种最荒诞的方式走向毁灭。
你可能很难想象这个画面:在某些戒备森严的扫描车间里,一本本出版于18世纪、存世仅几本的植物学孤本被送上流水线。冷冰冰的液压刀轰然落下,精准切掉泛黄坚硬的书脊。
接着,散落的页码被高速滚轮疯狂卷入扫描仪,化作一个个高清数字信号;几秒钟后,这些承载着数百年人类记忆的纸张,被直接打入粉碎机,瞬间化为一堆废纸屑。
这不是某种极端宗教组织的“焚书”现场,也不是科幻小说里的末日寓言。这是2026年发生在硅谷科技巨头产业链上最真实的日常。
甚至连马斯克都坐不住了,紧急向自己的团队下达死命令:在采集资料时必须改用无损扫描,给古籍留个“全尸”。
究竟是什么疯癫的逻辑,逼得这群掌控着人类最顶尖科技的超级巨头,开始像蛮族一样破坏人类遗产?
一、AI正在“吃掉自己的吐泄物”答案简单到可以用一句话概括:互联网上的数据,已经被彻底污染了。
自从2022年大模型爆发以来,AI生成的文本、垃圾SEO文章、低质新闻和造假评论以几何级数充斥着整个网络生态。
如果你让一个全新的AI模型,去吞食2022年之后互联网上的公开数据,就会触发学术界所说的“模型坍塌”。
这就像是“近亲繁殖”或者“数字毒性蓄积”。AI吃着上代AI吐出来的废话,生成更庸俗的废话,几轮迭代下来,模型的逻辑能力和创造力就会彻底崩溃。
为了防止AI变傻,硅谷巨头们陷入了空前的“纯净数据焦虑”。他们需要大量“未经AI污染过”的、高密度、高质量的人类原创文字。
上哪儿去找这种绝对干净的数据?只有2022年之前出版的实体纸质书。
那是人类文字最后的净土。每一本经过编辑审查、文字校对、纸张印制的老书,都是未经数字废料侵蚀的纯净矿藏。
二、法律缝隙下的“现代焚书坑”为了把这些纸上的智慧变成算法的养料,一条极其隐秘的古籍收割产业链应运而生。
AI巨头们极力隐藏自己的身份。他们通过像 ISBNdb (一个庞大的全球图书数据中介平台,类似图书界的大宗商品交易中介/数据检索库)这样的中介机构,以“数字保存”的名义,单次匿名采购上百万册老书,并签署极其严格的保密协议。
最令人齿冷的是,这场浩劫竟然得到了法律的“默许”。
美国联邦法官裁定,这种“切书-扫描-粉碎”的操作属于“合理使用”。理由听起来既冠冕堂皇又充满诡辩:只要把实体纸质书彻底粉碎,世界上就只剩下一份数字电子版,这就不构成“多重复制”和侵权。
为了规避版权风险,他们宁可毁掉实体书。
甚至为了干得更高效,像 Anthropic 这样的顶级AI公司,直接把前谷歌图书(Google Books)的负责人挖来专门掌管这项业务。一群曾经高唱“将人类知识数字化”的精英,如今成了最精准的“书籍绞肉机”操盘手。
三、资本对人类公地的终极掠夺这不仅仅是一场技术危机,更是一次前所未有的人类文明掠夺。
过去,一本古籍保存在图书馆或私人藏家手里,它是全人类共同的记忆,是属于公共领域的文化遗产。所有人都可以翻阅它,感受纸张的质感,体悟历史的温度。
但现在,科技资本用巨额资金把这些文化遗产买断、切碎、粉碎。
它们把原本属于全人类的实体知识,通过暴力的手段“抽干骨髓”,炼化成私人服务器里的向量数据和参数矩阵,再封装成收费的 API 接口,高价卖回给人类。
这是典型的“公共公地私有化”。
他们一边用AI垃圾充斥互联网,剥夺了普通人获取纯净信息的权利;一边又暗中私有化人类最珍贵的文字遗产,把知识筑造成极少数巨头垄断的数字高墙。
当纯净的文字变成了稀缺资产,当实体纸张被当成工业废料般绞碎,我们不禁要问:
如果一个技术文明的演进,必须以消灭人类的历史记忆为代价;如果未来最纯粹的人类智慧,只能藏在资本家戒备森严的机房里,那么,我们创造出来的,到底是带我们走向未来的通天塔,还是一座吞噬文明本身的无底黑洞?
评论列表