一项新的基准测试 ACII-DaiKon 已推出,用于评估模型在双人对话中的人际动态。该基准测试侧重于方向性影响、轮流发言和融洽关系发展,超越了以说话者为中心的方法。它利用了 Hume-DaiKon 数据集,该数据集包含五种语言的 700 多个小时的视听数据,以支持多模态和时间推理。 AI
影响 为对话式 AI 建立了新的评估标准,推动研究朝着更细致地理解人际动态方向发展。
排序理由 这是一篇介绍对话式 AI 新基准测试和数据集的研究论文。
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →