研究人员推出了SocialOmni,这是一个旨在评估全模态大语言模型(OLMs)社交交互性的新基准。该基准评估三个关键维度:说话人识别、打断时机和自然打断生成。对12个领先OLMs的测试揭示了它们在社交互动能力方面存在显著差异,突显了感知准确性与生成上下文适当的对话响应能力之间的脱节。 AI
影响 该基准有望推动更具社交能力的AI对话代理的开发。
排序理由 该集群包含一篇介绍AI模型评估新基准的学术论文。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →