实体
Sonic 3.5
Sonic 3.5
PulseAugur coverage of Sonic 3.5 — every cluster mentioning Sonic 3.5 across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 3 条
-
Together AI 发布 Cartesia Sonic 3.5 以实现实时 TTS
Together AI 宣布发布 Cartesia Sonic 3.5,这是一款专为实时应用设计的新型文本转语音 (TTS) 模型。该模型具有低于 90 毫秒的延迟,支持 42 种语言,并具备上下文感知发音和准确的文本跟随功能。开发者现在可以通过 Together AI 的语音查找器工具访问超过 150 种 Cartesia Sonic 3.5 语音,以便在部署前进行比较和选择。
-
Together 发布 Sonic-3.5 和 Ink-2 用于语音处理
Together 发布了两个新模型:用于文本转语音的 Sonic-3.5 和用于语音转文本的 Ink-2。这些模型专为实时流式应用而设计,并声称是各自领域的顶级模型。Together 现在是唯一一家提供领先的音频输入和输出模型的供应商。
-
2026年顶级TTS模型在质量、准确性和延迟方面进行基准测试
文本转语音(TTS)领域发展迅速,模型现已达到接近人类的语音质量和实时能力。诸如Artificial Analysis Speech Arena和Hugging Face的TTS Arena等关键基准通过人类偏好评估模型,其中Gemini 3.1 Flash TTS、Realtime TTS-2和Sonic 3.5等表现最佳。除了感知质量,诸如往返字符错误率和首次音频生成时间等指标分别对于评估准确性和延迟至关重要。Inworld AI…