研究人员推出了一种新颖的视觉-语言-动作(VLA)模型DriveVLA-M0,旨在通过从过去的故障中学习来改进自动驾驶系统。该模型包含一个故障感知的潜在记忆,用于存储问题场景和专家轨迹。在推理过程中,一种检索机制会识别过去的类似故障,并使用一种轻量级的基于LoRA的训练方法来实时纠正模型的行为,而无需改变核心架构。在NAVSIMv1和NAVSIMv2基准上的实验表明,DriveVLA-M0在Navtest和Navhard上取得了高分,同时保持低延迟,性能显著提高。 AI
影响 该模型的故障感知记忆有望带来更强大的自动驾驶系统,使其能更好地适应挑战性场景。
排序理由 该集群包含一篇详细介绍新模型及其实验结果的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →