The audio.cpp project has released version 0.7, significantly expanding its support for audio models to 62 families and over 85 variants. This update introduces an Arena UI, allowing users to compare outputs from multiple local models simultaneously. The release also includes new models for text-to-speech, automatic speech recognition, voice conversion, and music generation, with a focus on performance on edge hardware like NVIDIA Jetson Orin. AI
IMPACT Expands local AI model comparison capabilities and broadens support for diverse audio AI tasks.
RANK_REASON This is a software release for a tool that integrates various AI models, not a release from a frontier AI lab.
- Arena UI
- audio.cpp
- ControlFoley
- FireRed TTS3
- Minimax Music 3
- PersonaPlex
- Release 0.7
- ACE-Step 1.5 XL
- AudioSR
- FireRedAudio
- IBM Granite Speech 5.0 TurboCTC
- MeanVC2
- MiDashengLM-Gen
- MMS Forced Aligner
- NVIDIA Jetson Orin
AI-generated summary · Google Gemini · from 2 sources. How we write summaries →