PulseAugur
实时 20:36:51
实体 OpenMOSS-Team

OpenMOSS-Team

PulseAugur coverage of OpenMOSS-Team — every cluster mentioning OpenMOSS-Team across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 4
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 4 条
  1. TOOL · CL_104997 ·

    OpenMOSS-Team 发布 MOSS-TTS-Local-Transformer-v1.5,增强了音频保真度和多语言支持

    OpenMOSS-Team 发布了其文本转语音模型 MOSS-TTS-Local-Transformer-v1.5 的更新版本。新版本在 v1.0 的基础上,提供了更高保真度的立体声音频建模,采样率为 48 kHz。它还通过语言标签改进了多语言合成,支持更稳定的语音克隆,更好地处理长参考音频以进行短文本克隆,并实现了更精确的标点符号跟随韵律。该模型现在支持使用内联标记进行显式停顿控制,并将语言支持扩展到 31 种语言,包括新增的粤语、…

  2. RESEARCH · CL_52628 ·

    LiquidAI发布设备端LFM2.5-8B-A1B;OpenMOSS-TTS v1.5新增语言

    LiquidAI发布了LFM2.5-8B-A1B,这是一个为设备端部署优化的新型混合模型系列,在CPU和GPU上均提供与大型模型相媲美的性能和高推理速度。同时,OpenMOSS-Team发布了MOSS-TTS-v1.5,这是一个更新的文本转语音模型,增强了多语言合成、语音克隆稳定性和显式停顿控制,现支持31种语言。

  3. TOOL · CL_55910 ·

    OpenMOSS 发布 MOSS-TTS-v1.5,增强了语音克隆和多语言支持

    OpenMOSS团队发布了MOSS-TTS-v1.5,这是他们文本转语音模型的更新版本。新版本在MOSS-TTS 1.0的功能基础上,引入了增强的多语言合成(支持语言标签)、更稳定的语音克隆(以提高说话人相似度),以及对长参考、短文本克隆场景的更好处理。MOSS-TTS-v1.5还提供了更稳定的标点符号韵律遵循,并通过内联标记引入了显式的停顿控制。

  4. RESEARCH · CL_134287 ·

    OpenMOSS-Team发布MOSS-Transcribe-Diarize 0.9B用于音频理解

    OpenMOSS-Team发布了MOSS-Transcribe-Diarize 0.9B,这是一款专为全面音频理解设计的端到端模型。该模型一次性完成转录、说话人分离和时间戳生成,为长篇音频和视频内容生成结构化、说话人感知的文本。它特别适用于会议、通话和讲座等应用,还可以识别声音事件。