研究人员开发了两种新的世界动作模型,DiffWAM 和 DroneWAM,旨在提高无人机视觉导航的效率。DiffWAM 直接将预测视频特征转换为连续的相机轨迹,在其基准测试中实现了 0.3492 米的轨迹 RMSE,并展示了复杂的飞行行为。DroneWAM 利用基于 JEPA 的架构和 Resampler,在表示空间中对未来状态进行建模,以避免昂贵的未来图像生成,并结合自适应展开以优化预测深度,在其 DroneNav-6D 数据集上显示出改进的轨迹精度。 AI
影响 这些模型通过直接使用预测视频表示,提供了更高效、更准确的无人机导航,有可能提高自主飞行能力。
排序理由 两篇介绍新型无人机导航模型的论文。
在 Hugging Face Daily Papers 阅读 →
- arXiv
- DagsHub
- DiffWAM
- DiffWAM-1000
- DroneNav-6D
- DroneWAM
- FastDreamer
- Gate
- Hugging Face
- NVIDIA Jetson AGX Thor
- Resampler
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →