Google 推出了两款新的先进音频模型 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,旨在增强语音代理能力,使 AI 对话更加自然。Gemini 3.8 Live 专注于速度、成本效益以及处理 97 种语言的句子中断,并集成视觉上下文以完成分步说明等任务。Gemini 3.8 Live Extended Thinking 通过并行推理和语音输出,甚至可以叙述其进度,为复杂的、多步骤的任务提供更深层次的智能。 AI
影响 这些先进的音频模型有望显著提升语音代理能力,使消费者、开发者和企业能够更自然、更高效地与 AI 进行交互。
排序理由 前沿实验室模型发布,附带系统卡。
- Gemini 3.8 Live
- Gemini 3.8 Live Extended Thinking
- Gemini API
- Gemini app
- Gemini Enterprise
- Gmail
- Google AI
- Google AI Studio
- Google Docs
- Google Workspace
- Search Live
- Artificial Analysis
- Big Bench Audio
- EVA-Bench
- Fishjam
- Gemini Enterprise Agent Platform
- Google DeepMind
- ServiceNow
- Speech Agent Arena
AI 生成摘要 · Google Gemini · 来自 4 个来源。 我们如何撰写摘要 →