研究人员推出RadSight,一款新推出的用于放射影像理解的多模态大语言模型。现有模型在基本视觉解释方面存在困难,导致诊断不可靠。为解决此问题,开发了一个包含超过一百万个样本的新基准Perception-Bench,用于评估MLLM在六个关键维度上的表现。RadSight采用双2D/3D编码器架构构建,并在大型以感知为导向的语料库上进行训练,在Perception-Bench和其他医学基准上表现优越,凸显了强大的低级视觉感知对准确临床诊断的重要性。 AI
影响 这项研究通过提高医学LLM的基础视觉感知能力,有望在医疗保健领域带来更可靠的AI诊断工具。
排序理由 该集群描述了一篇介绍特定领域新模型和基准的新研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →