PulseAugur
实时 10:54:53
English(EN) SkillMoV: Mixture-of-View Routing with Prototype-Conditioned Gating for Unified Multi-View Proficiency Estimation

SkillMoV框架增强多视角视频技能估计

研究人员开发了SkillMoV,一个用于从多视角视频估计人类熟练度的新颖框架。该参数高效系统利用了混合视角投影仪(MoVP),该投影仪将混合专家范式应用于不同的摄像机视角。SkillMoV结合了软路由、跨视角注意力、原型锚定和门控投影来生成技能嵌入。在EgoExo4D数据集上进行评估时,SkillMoV在Exos设置中实现了50.17%的总体准确率,以单一、联合训练的模型,比现有方法提高了3.57个百分点。 AI

影响 通过改进多视角视频分析,增强了各领域自动化技能评估。

排序理由 该集群包含一篇详细介绍新框架及其在数据集上评估的研究论文。

在 arXiv cs.AI 阅读 →

AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →

SkillMoV框架增强多视角视频技能估计

报道来源 [2]

  1. arXiv cs.AI TIER_1 English(EN) · Edoardo Bianchi, Antonio Liotta ·

    SkillMoV:用于统一多视角熟练度估计的混合视角路由与原型条件门控

    arXiv:2606.17615v1 Announce Type: cross Abstract: Estimating human proficiency from video is a key challenge for automated skill assessment, with applications in sports coaching, music pedagogy, surgical training, and workplace learning. Existing approaches often focus on individ…

  2. arXiv cs.CV TIER_1 English(EN) · Antonio Liotta ·

    SkillMoV:用于统一多视图熟练度估计的混合视图路由与原型条件门控

    Estimating human proficiency from video is a key challenge for automated skill assessment, with applications in sports coaching, music pedagogy, surgical training, and workplace learning. Existing approaches often focus on individual scenarios or rely on shared multi-view aggrega…