PulseAugur
中
实时 23:35:25
实体 Big Bench Audio

Big Bench Audio

PulseAugur coverage of Big Bench Audio — every cluster mentioning Big Bench Audio across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
4
90 天内 4
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天

2 天有情绪数据

最近 · 第 1/1 页 · 共 4 条
  1. FRONTIER RELEASE · CL_256594 ·

    Google推出Gemini 3.8 Live音频模型,实现流畅的AI对话

    Google推出了两款新的音频模型Gemini 3.8 Live和Gemini 3.8 Live Extended Thinking,旨在增强对话式AI代理。这些模型支持实时交互,使代理能够在继续流式传输音频响应的同时执行API调用和工具执行等任务。Extended Thinking变体特别支持可配置的“思考”过程,允许用户打开或关闭AI的内部推理,并且可以在不中断用户对话的情况下在后台执行任务。这一进步旨在降低交互延迟,提高语音代理…

  2. FRONTIER RELEASE · CL_255943 ·

    Google发布Gemini 3.8 Live和Extended Thinking音频模型

    Google发布了Gemini 3.8 Live和Gemini 3.8 Live Extended Thinking,这两款新的先进音频模型旨在增强语音代理功能并创造更自然的AI对话。Gemini 3.8 Live专注于规模、速度和成本效益,能够处理句子中途打断和多语言转换,而Gemini 3.8 Live Extended Thinking通过并行推理和语音处理,为复杂的、多步骤任务提供更深层次的智能。这些模型正通过API向消费者、…

  3. TOOL · CL_108994 ·

    Loka 使用 Amazon Nova 2 Sonic 构建低延迟语音助手

    Loka 使用 AWS 的语音到语音模型 Amazon Nova 2 Sonic 开发了一个对话式 AI 语音助手。这种新方法对音频进行端到端处理,捕捉了传统基于文本的流程中丢失的细微差别,并显著降低了延迟。该系统在大语言模型音频基准测试(Big Bench Audio)上取得了高分,优于 Gemini 2.5 Flash Native Audio 和 GPT Realtime 等竞争对手,同时还提供了大规模部署的成本效益。

  4. FRONTIER RELEASE · CL_14918 ·

    OpenAI 发布 GPT-5 级语音模型,支持实时推理、翻译和转录

    OpenAI 发布了三款新的实时语音模型:GPT-Realtime-2、GPT-Realtime-Translate 和 GPT-Realtime-Whisper。这些模型提供了增强的推理能力、对 70 多种语言的实时语音翻译以及低延迟转录。特别是 GPT-Realtime-2,被描述为具有“GPT-5 级推理”能力,并拥有显著扩展的 128K 令牌上下文窗口,同时改进了对中断和工具使用的处理。