据报道,科技公司正在购买和销毁旧书,将其内容用作人工智能模型的训练数据。这种做法涉及剪断书脊和扫描页面,因其破坏性和对文化遗产的漠视而受到批评。虽然人工智能需要大量的文本(包括书籍)进行训练,但存在非破坏性的替代扫描方法,例如Google已获得专利并由Internet Archive使用的方法。争论的焦点在于数字化是否应作为公共利益,同时保存文本和实体物品,还是作为数据的私人提取,将书籍仅仅视为原材料。 AI
影响 引发了关于文化遗产的长期保护与人工智能发展的数据需求之间的伦理问题。
排序理由 文章讨论了人工智能公司为训练数据销毁书籍的伦理影响,将其视为文化问题,而不是直接的人工智能发布或研究。
在 Mastodon — fosstodon.org 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →