我的注意力被一个令人不安的趋势所吸引:在亚马逊位于拉斯维加斯的一个物流设施中,正在大规模进行图书数字化,这实际上意味着图书的物理销毁。这不仅仅是简单的扫描,而是一种野蛮的流程:将书籍的装订线切掉,拆分成单独的纸张,然后通过工业扫描仪。经过处理后,这些书籍已无法恢复原状。
计划是如何被揭露的
起点是二手书商那里出现的异常订单。卖家记录到有批发采购数百本各种主题和出版年份的书籍,其中包括真正的珍本。7月,一家商店通过Biblio平台收到了一位匿名买家约一千本图书的订单。卖家同意追踪这批货的命运,在其中一本书中藏了一个Apple AirTag追踪器。
信号直接指向了位于北拉斯维加斯的亚马逊设施,那里设有VGT3部门。对员工发布内容的分析及其个人证词证实:这不是仓库,而是一个印刷品处理车间。工人们描述了一条清晰的流水线:登记副本、扫描条形码和ISBN、切割装订线以及随后的页面数字化。
公司隐藏了什么
值得注意的是,亚马逊此前并未公开宣传这项活动。在回应询问时,该公司仅确认通过商业渠道购买印刷出版物,并将其用于“开发和改进产品与服务”。然而,关键细节——采购量、项目时间表以及为其准备数据的具体AI模型——仍未公开。
2026年初,该平台甚至出现了供应中断的情况:书籍有时会缺货,这间接表明了该操作的规模。显然,亚马逊已融入全球AI公司购买实体书作为高质量文本数据来源以训练语言模型的趋势。
我的分析:这种情况是行业系统性问题的明显症状。我们正在目睹企业在数据竞赛中摧毁文化遗产,却未向作者和出版商提供合理的补偿。只要AI行业继续走阻力最小的路径,购买并粉碎稀有书籍,这种做法的合法性和伦理问题就仍将是整个市场的一颗定时炸弹。