研究人员推出了一种新颖的端到端驾驶框架SUV,该框架将未来场景理解视为一项视频生成任务。该方法利用预训练的视频基础模型,将未来外观、语义、深度和实例级动态预测为视频流。然后,一个动作专家通过关注这些预测的未来流来生成自我轨迹。SUV在NAVSIM-v2和WOD-E2E等基准测试中表现强劲,仅使用一个前置摄像头就超越了多种最先进的方法。 AI
影响 这项研究可能为自动驾驶系统带来更具可扩展性和连贯性的未来场景预测。
排序理由 该集群包含一篇详细介绍新AI驱动驾驶框架的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →