研究人员发布了CalTennis,一个用于评估单目到3D人体姿态估计的大规模视频数据集。该数据集包含来自40名球员的超过1100万帧网球比赛画面,通过多个同步摄像头捕捉。这个基准比现有数据集大得多,能够进行无标签的姿态估计算法评估,突出了当前模型在深度和脚部接触估计方面的局限性,同时提出了新的性能分析指标。 AI
影响 为推进单目到3D姿态估计提供了一个大规模基准,有望改进体育分析和人机交互等应用。
排序理由 该集群描述了在arXiv上发布的用于计算机视觉研究的新数据集和基准。
- arXiv
- CalTennis
- Monocular-to-3D Pose Estimation
- alphaXiv
- Caltech Tennis Dataset
- DagsHub
- Hugging Face
- motion capture
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →