问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年8月业界消息显示,早年靠线上图书零售起家的科技巨头亚马逊,正批量销毁市面稀缺的绝版、稀有古籍,将内容数字化后用于大语言模型(LLM)训练。由于当前主流大模型已完成公开网络内容训练,稀缺印刷品成为AI训练的核心增量资源,该事件已引发出版界、文化保护界的广泛争议。

2026年以来,全球大模型厂商的训练数据争夺战已经从公开网络延伸到了线下实体资源领域,其中存量稀少、内容独有的古旧印刷品成为头部企业争抢的核心标的。
当前多数通用大模型已经完成了对公开网络文本、正式出版电子书籍等公域内容的训练覆盖,进一步提升模型的知识广度、专业领域精准度,需要大量未被数字化的独有内容支撑。据AI训练行业测算,未公开的稀缺印刷品内容对大语言模型的知识边界拓展效率,是普通公开网络内容的4倍以上。
而亚马逊作为全球布局最广的图书零售商,拥有覆盖全球的古旧书回收、仓储体系,其库存的1923年之前出版的公域稀有古籍总量超过1200万册,是全球持有同类资源最多的商业机构,天然具备其他AI厂商无法比拟的内容优势。
1994年亚马逊成立时,核心业务正是线上图书零售,靠图书品类积累的用户信任和供应链能力,才逐步扩张为如今的综合科技巨头。此次被曝出的销毁古籍操作,是亚马逊将稀缺古籍扫描完成数字化后,直接对实体书进行粉碎处理,一方面可节省高额的稀有书籍仓储成本,另一方面也能避免独有内容资源被竞争对手获取。
该消息曝光后,美国古旧书商协会、全球文化遗产保护组织先后发表声明,指责亚马逊为商业利益破坏具有文化价值的实体文物,要求其立即停止销毁行为,将完成数字化的实体古籍捐赠给公共图书馆或文化机构。
该事件背后暴露出的,是当前全球AI训练数据监管的空白地带。目前各国对于已进入公域的文化资源能否用于商用AI模型训练、使用方是否需要履行文化保护相关义务,尚未出台明确的法律规定。此前多个头部AI厂商都曾曝出私自扫描图书馆馆藏书籍用于训练的纠纷,但均未受到明确的处罚约束。
业内人士指出,亚马逊此次事件很可能成为推动相关监管政策落地的导火索,未来监管层大概率会要求AI企业在使用稀有文化资源训练模型时,履行资源备案、实体捐赠、收益反哺文化事业等相关义务,平衡AI产业发展和文化资源保护的需求。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。