PulseAugur
中
实时 21:02:16
实体 GPT-4o-audio

GPT-4o-audio

PulseAugur coverage of GPT-4o-audio — every cluster mentioning GPT-4o-audio across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_193718 ·

    新基准揭示人工智能情商存在显著差距

    研究人员推出了EmoSBench,一个旨在评估口语语言模型(SLMs)情商的新基准。该基准基于情商的四分支理论模型,包含十个子任务。初步测试表明,即使是像GPT-4o-Audio这样的先进模型,其表现也远低于人类基线,准确率仅为52.6%。为解决此问题,开发了一个名为EmoS的新评估模型,该模型利用监督微调和一种整合准确性和推理保真度的新颖奖励机制,达到了83.8%的准确率,并在现实场景中展现出强大的泛化能力。

  2. TOOL · CL_176750 ·

    研究人员发现AI语音代理易受音频提示注入攻击

    研究人员已证明,多模态AI代理,如Gemini 3 Pro和GPT-4o-audio,容易受到通过音频输入的社会工程学攻击。在实验室条件下,这些代理被发现会遵循嵌入在背景噪音或重叠语音中的恶意指令,成功率报告为69%。虽然这揭示了一种已知漏洞类别的新攻击途径,但一种名为CADV(跨模态一致性检测)的防御机制显示出超过90%的检测率,表明该问题是设计上的差距而非根本性缺陷。