PulseAugur
实时 10:04:37

New models analyze multimodal dialogue using speech and gesture

研究人员开发了分析多模态对话的模型,结合语音和骨骼手势数据来识别指代物。研究发现,仅凭手势就能传达重要的指代信息,而语音与手势的结合可以提高模型的性能,尤其是在语音含糊不清的情况下。研究还观察到,在视频介导的对话中,伙伴可见性对姿态产生的影响以及在重复回合中人类互动中的趋同效应。 AI

影响 增强对多模态通信的理解,以改进对话系统。

排序理由 该集群包含一篇详细介绍分析多模态对话新研究方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.CL 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

New models analyze multimodal dialogue using speech and gesture

报道来源 [1]

  1. arXiv cs.CL TIER_1 English(EN) · Esam Ghaleb, Hugh Mee Wong, Kristina Kobrock ·

    视频中介对话中不同伙伴可见度条件下的多模态信息量研究

    arXiv:2608.08915v1 Announce Type: new Abstract: Situated language use is multimodal and embodied. For example, gestures can carry information that is absent or underspecified in the speech signal, yet dialogue models typically rely on transcripts alone. We study how much referent…