研究人员推出GRAVA,一个用于自动驾驶的新框架,增强了视觉-语言-行动(VLA)模型的推理和行动方式。GRAVA的核心创新在于其基于推理到行动(GRA)的方法,该方法将语言参考与视觉场景证据和物理状态紧密联系起来,在一个结构化图中组织决策,然后生成可执行的行动。该框架包括一个数据构建管道和一个渐进式训练策略,在NAVSIM和内部长尾数据集等基准测试中取得了改进的性能。 AI
影响 这项研究通过改进AI模型连接视觉输入与决策制定,有望带来更可靠、更可解释的自动驾驶系统。
排序理由 该集群描述了一篇详细介绍自动驾驶新框架和模型的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- Connected Papers
- DagsHub
- GRAVA
- GRAVA-8B
- Grounded Reasoning-to-Action
- Hugging Face
- Litmaps
- NAVSIM
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →