研究人员推出了PubMed-Ophtha,这是一个包含从科学文献中提取的超过10万对眼科图像-字幕的新数据集。该数据集旨在解决医学领域训练视觉语言模型高质量数据稀缺的问题。提取过程包括对PDF中的图进行详细分解、对成像模态进行标注以及复杂的基于LLM的字幕分割,在检测和提取任务中实现了高精度。 AI
影响 提供了一个大规模、标注过的数据集,以加速眼科领域专业视觉语言模型的发展。
排序理由 该集群描述了为研究目的发布的新数据集和相关模型。
AI 生成摘要 · Google Gemini · 来自 5 个来源。 我们如何撰写摘要 →