AI公司正越来越多地从旧的印刷书籍中获取训练数据,特别是那些在2022年之前出版的书籍。此举旨在避免“模型崩溃”,即由AI生成文本训练出的AI模型效果会下降的现象。像ISBNdb这样的公司正在促进这些批量采购,为AI实验室提供匿名性,并帮助他们扫描和处理数百万册书籍。这一趋势因Anthropic和Google被指控使用受版权保护的书籍训练其模型而提起的诉讼而受到关注。 AI
影响 这一趋势凸显了AI发展中潜在的瓶颈,并可能导致对实体书的需求增加以及对数据策展新方法的需求。
排序理由 该集群讨论的是AI公司采用的一种趋势和策略,而不是具体的产品发布、研究突破或政策变化。
- Anthropic
- Better World Books
- Google Gemini
- International Standard Book Number
- ISBNdb.com
- The Washington Post
AI 生成摘要 · Google Gemini · 来自 3 个来源。 我们如何撰写摘要 →