PulseAugur
中
实时 22:56:33
实体 Fun-ASR-Nano

Fun-ASR-Nano

PulseAugur coverage of Fun-ASR-Nano — every cluster mentioning Fun-ASR-Nano across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_244111 ·

    Hugging Face Transformers v5.17.0 新增 HYV4、VibeVoice、NeoMME 等模型

    Hugging Face Transformers 库发布了 5.17.0 版本,引入了多个新模型和框架。新增的亮点包括 HYV4,一个拥有 100 万 token 上下文窗口的 780B 参数混合专家语言模型;以及 VibeVoice,一个基于扩散的高保真语音合成框架。本次发布还包括 NeoMME,一个多模态原生多语言基础编码器;以及 Fun-ASR-Nano,一个支持多种语言和方言的高效端到端语音识别模型。此外,Kimi Line…

  2. TOOL · CL_175672 ·

    audio.cpp 0.5 增加了 DramaBox TTS、Confucius4 语音转换和 AMD GPU 支持

    audio.cpp 项目已发布 0.5 版本,对其文本转语音 (TTS) 和语音转换功能进行了重大更新。一个主要亮点是 DramaBox,一个专为提示词驱动的配音设计的新模型,可控制情感和表达。该版本还推出了 Confucius4-TTS 用于跨语言语音转换,并集成了其他几个模型和 ASR 系统。平台支持的增强功能包括对 AMD GPU 的早期 HIP/ROCm 兼容性以及对 Apple Silicon 的性能改进,同时还改进了直播和摄入功能。