Anthropic 通过破坏性扫描纸质书训练大模型引争议
昨天
《纽约客》文章讨论 AI 公司 Anthropic 为训练 Claude 模型开展的 Panama 项目:该公司以神秘公司名义大量购买 20 世纪 70 年代以来的冷门学术书等,送往工业设施进行破坏性扫描即拆书扫描后丢弃纸质本,目标获取全世界所有书籍。法律层面,法官认定使用合法书籍训练 AI 及格式转换属于合理使用,Anthropic 此前也和解了版权诉讼。但争议核心在于透明度与文化意义:Anthropic 的「研究图书馆」只为提取数据,外界无法知晓模型吸收的书籍及信息来源。专家认为,AI 将书籍转化为可重组数据,抹除了书籍的历史、语境、阅读顺序等深层价值,这种隐蔽抹除比物理毁书更值得担忧。不过也有人认为这类冷门书进入模型或能发挥更大价值,且未来仍会有人追求原始阅读体验。此外,Anthropic 的招股书披露时间推迟,目前中国大模型公司暂无相关实践的公开信息。
Anthropic 是如何毁书来训练大模型的
投资界/maomu.com/36Kr
2026-09-11
Anthropic 通过破坏性扫描纸质书训练大模型引争议2025-06-26
为训练 AI 模型,Anthropic 耗资数百万美元购入并「销毁」巨量图书体验专业版特色功能,拓展更丰富、更全面的相关内容。