Microsoft Research 发布了 VibeVoice-ASR-Streaming-7B,一个统一的流式自动语音识别 (ASR) 模型。该模型提供连续的说话人识别转录,支持针对特定领域的自定义热词,并包含十种语言的多语言能力。它可与 Transformers 等库一起使用,并可集成到笔记本和本地应用程序中。 AI
影响 支持实时、说话人归属的转录,并针对特定领域和多种语言进行定制。
排序理由 研究部门发布特定模型。[lever_c_降级自研究: ic=1 ai=1.0]
在 Hugging Face Trending Models 阅读 →
- Google Colab
- Kaggle
- Microsoft Research
- microsoft/VibeVoice-ASR-Streaming-7B
- transformers
- VibeVoice
- VibeVoice-ASR-Streaming
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →