PulseAugur
实时 19:28:44
实体 Audio MultiChallenge

Audio MultiChallenge

PulseAugur coverage of Audio MultiChallenge — every cluster mentioning Audio MultiChallenge across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
  1. RESEARCH · CL_93553 ·

    新的解码方法弥合口语对话系统中的上下文鸿沟

    研究人员引入了一种名为上下文感知解码(CAD)的新方法,以改进口语对话系统在多个对话轮次中保持上下文的方式。该方法解决了模型可能在内部理解相关历史信息但未能积极在输出生成过程中使用它的挑战。通过分离和放大关键的历史上下文信号,CAD 旨在确保更忠实、更连贯的对话。

  2. FRONTIER RELEASE · CL_14918 ·

    OpenAI 发布 GPT-5 级语音模型,支持实时推理、翻译和转录

    OpenAI 发布了三款新的实时语音模型:GPT-Realtime-2、GPT-Realtime-Translate 和 GPT-Realtime-Whisper。这些模型提供了增强的推理能力、对 70 多种语言的实时语音翻译以及低延迟转录。特别是 GPT-Realtime-2,被描述为具有“GPT-5 级推理”能力,并拥有显著扩展的 128K 令牌上下文窗口,同时改进了对中断和工具使用的处理。