研究人员开发了一种新颖的两阶段系统,利用音频表示来检测和跟踪隐藏的动态对象。第一阶段涉及受联合嵌入预测架构(JEPA)的启发,在原始音频波形上进行自监督预训练,以根据过去的上下文预测未来的音频片段。随后,使用具有三个分类头的双向LSTM进行监督多任务微调,以估计车辆数量、类型和到达方向。该系统在一个新收集的数据集上进行了评估,与现有方法相比表现出优越的性能,并显示出可转移到未见过的驾驶场景的鲁棒表示。 AI
影响 这项研究可以通过提高自动驾驶汽车利用音频线索检测和跟踪隐藏对象的能力来增强其安全性。
排序理由 该集群包含一篇详细介绍新AI方法的论文。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- arXiv
- CatalyzeX
- DagsHub
- Gotit.pub
- Hugging Face
- Katerina Vinciguerra
- long short-term memory
- ScienceCast
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →