260723 期
《AI 公司抢购旧书,只因它们没有“AI 污染”》
AI 公司为获取没有生成内容污染的训练数据而批量采购旧书,由此引出版权、数据来源透明度与文化保存的伦理争议。
精准输入
导语
当互联网文本越来越混入 AI 生成内容,出版于大模型时代之前的纸质书反而成了稀缺的“干净数据”。本文追踪一家图书数据库、匿名批量买家和旧书商的异常订单,揭示 AI 公司如何把旧书变成训练材料,以及这一过程对版权、稀有藏书和实体书保存造成的争议。
我的笔记
✍️ 写下你的想法,自由记录即可。如果没有灵感,试着回答上方的费曼输出问题。
登录后可记笔记
登录后可保存笔记、高亮、划线和批注。