研究人员开发了一个名为 Institutional Books - Visual Elements 的开源管道,旨在从数字化的历史图书收藏中提取、分类、去重和标注视觉组件。该管道以及一个包含 2260 万个视觉元素的初始数据集已经发布,以促进对数字化图书馆材料的新应用。该项目旨在使插图和照片等视觉元素更容易用于计算用途,包括 AI 模型训练和数字人文研究。 AI
影响 通过计算访问实现数字化图书馆收藏的新用例,包括 AI 模型训练。
排序理由 该项目描述了一个用于处理数字化图书中视觉元素的开源管道和数据集发布,属于文化遗产计算访问方面的研发。 [lever_c_demoted from research: ic=1 ai=0.7]
- arXiv
- Hugging Face
- Institutional Books: Harvard Library
- Institutional Books - Visual Elements
- Matteo Cargnelutti
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →