audio.cpp 项目已发布 0.4 版本,引入了对多种新的高质量文本转语音 (TTS) 和自动语音识别 (ASR) 模型支持,包括 Higgs Audio v3 TTS 4B 和 Fish Audio S2 Pro。此版本还全面集成了 GGUF 格式支持所有模型家族,提供了显著的速度和 VRAM 提升,尤其是在 Q8 量化方面。该项目现支持 35 个模型家族,并新增了社区模型区域以支持更成熟的移植。 AI
影响 增强了本地 LLM 在音频处理方面的能力,提供了更快、更高效的 TTS 和 ASR。
排序理由 这是一个特定工具的软件发布,而非前沿模型发布或重大的行业事件。
- audio.cpp
- CPP
- Fish Audio S2 Pro
- GGML
- GGUF
- Higgs Audio v3 TTS 4B
- OuteTTS TTS
- VieNeu-TTS-v3
- Voxtral Realtime ASR
- Qwen3-TTS
- RTX 5090
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →