AI资讯
ISBNdb 下架 AI 相关测试页面,因粉碎珍稀图书用于训练引发争议
ISBNdb 下架了与 AI 训练相关的测试页面,原因是近期大量珍贵图书被粉碎用于训练大语言模型,引发了广泛关注和批评。
AI云图智寻编辑部2026-08-02 09:06
阅读时间:约 2 分钟
本周,关于大量珍贵图书被集中粉碎用于训练大语言模型的消息引起了广泛关注。图书数据库网站 ISBNdb 在舆论压力下删除了与 AI 训练相关的测试页面,并表示从未从事相关业务。
争议焦点指向 ISBNdb
近日,一些图书供应商收到了数量异常庞大的图书订单,外界猜测这些订单来自希望获得高质量、干净训练数据的 AI 公司。ISBNdb 成为舆论焦点,因为该网站曾推出一项服务,似乎专门帮助 AI 企业与图书仓储机构建立联系。ISBNdb 在声明中表示,他们并不训练 AI 模型,也从未从事过相关业务,那个页面只是一次市场需求测试,相关服务从未真正上线,目前已经将页面删除。
AI 公司寻找高质量数据来源
随着 AI 公司越来越难获得“干净”的训练数据,它们正在寻找新的数据来源。互联网上大量低质量内容,以及越来越多由 AI 自己生成的内容,都可能导致模型训练出现“负反馈循环”问题。因此,各家公司希望获取质量更高的数据,同时尽量避免引发外界关注。今年夏天,电影公司 A24 就宣布与谷歌达成合作,为 DeepMind 提供训练素材,希望帮助其媒体生成模型摆脱大量质量低劣、风格混乱的 AI 内容。
销毁实体书的原因
据报道,销毁实体书并不是为了掩盖痕迹,也不是出于收藏稀有知识的目的。虽然“巴拿马计划”的相关文件并未说明销毁图书的具体原因,但最可能的解释仍然是为了降低成本。实际上,图书数字化扫描并不一定需要破坏原书,但如果整个流程追求低成本、高效率,就很可能直接拆掉书脊,以获得更平整、更清晰的扫描效果,随后再将已经损坏的书籍当作废纸处理。Anthropic 为此支付了高达 15 亿美元的和解协议,以避免相关做法被曝光。