研究人员开发了RAIDAL,一种新颖的主动学习方法,旨在提高连续手语识别(CSLR)模型训练的效率。该方法通过利用通常用于推理的CTC解码器来识别视频中的相关片段,从而解决了视频数据高昂的标注成本挑战。通过关注这些已识别的词条(gloss)区域,RAIDAL避免了冗余帧和停顿带来的噪声,从而实现了更有效的样本选择。跨多个数据集和架构的实验表明,RAIDAL显著提高了数据效率,尤其是在大规模词汇、预算受限的情况下。 AI
影响 提高了手语识别模型训练的效率,可能降低了辅助工具的门槛。
排序理由 详细介绍CSLR新方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →