Microsoft 发布了 VibeVoice-ASR-Streaming,一个开源的自动语音识别模型。该模型可在 Hugging Face 上获取,专为流式音频输入设计。 AI
影响 为从事实时语音识别的开发者提供了一个新的开源选项。
排序理由 这是由一家主要科技公司发布的开源模型,但它是一个特定工具,而不是前沿模型发布。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →
Microsoft 发布了 VibeVoice-ASR-Streaming,一个开源的自动语音识别模型。该模型可在 Hugging Face 上获取,专为流式音频输入设计。 AI
影响 为从事实时语音识别的开发者提供了一个新的开源选项。
排序理由 这是由一家主要科技公司发布的开源模型,但它是一个特定工具,而不是前沿模型发布。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →
完整方法见我们的编辑标准。
<table> <tr><td> <a href="https://www.reddit.com/r/LocalLLaMA/comments/1w5trnb/microsoft_vibevoiceasrstreaming_released/"> <img alt="Microsoft VibeVoice-ASR-Streaming Released" src="https://external-preview.redd.it/PFOaNnyVdYQFsoR-lI57VLaGgLks-TqgHnb743pgJgA.png?width=640&cro…