研究人员推出了一款名为 READI 的新型多模态基准,旨在评估 AI 模型在视觉语境中理解间接言语行为的能力。该基准支持英语和韩语,侧重于语用推理,这是当前最先进的模型难以掌握的一项能力,尤其是在言语行为的间接性增加时。研究结果表明,AI 在理解依赖语境的语用理解方面存在显著差距,尤其是在高语境语言中。 AI
影响 凸显了当前多模态 AI 在执行细致语用推理方面的局限性,表明需要更复杂的语境感知模型。
排序理由 该集群包含一篇介绍新 AI 研究基准的学术论文。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →