研究人员引入了一种名为信用可寻址推理的新方法,以改进大型语言模型中的多模态几何推理。该方法以 Code-CoT 和 CE-GRPO 的形式实现,将视觉关系表示为可执行代码,并将推理组织成类型化事件。CE-GRPO 在九个几何基准测试中的平均准确率为 76.04%,显著优于 Qwen3 VL 8B 和轨迹级别 GRPO。该方法在中间推理步骤复杂度增加时效果更佳,凸显了为复杂多模态任务共同设计表示和优化方法的优势。 AI
影响 增强了多模态推理能力,有望提高在复杂视觉和几何任务中的表现。
排序理由 这是一篇详细介绍新方法和基准测试结果的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →