PulseAugur
实时 19:58:21
实体 Miso Labs

Miso Labs

PulseAugur coverage of Miso Labs — every cluster mentioning Miso Labs across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 4
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 4 条
  1. SIGNIFICANT · CL_73435 ·

    Miso Labs 发布开源语音模型;Anthropic 准备 Claude Mythos

    Miso Labs 发布了一个开源的 8B 参数语音合成模型,其延迟为 110ms 并具备语音克隆能力。此举有望挑战 ElevenLabs 在市场上的主导地位。与此同时,据报道 Anthropic 正在准备推出 Claude Mythos,一个基于 Oceanus 检查点构建的模型,旨在比人类黑客更快地检测代码漏洞,并与即将发布的 OpenAI 版本竞争。

  2. SIGNIFICANT · CL_70681 ·

    Miso Labs 发布开放权重的 8B TTS 模型 MisoTTS

    Miso Labs 发布了 MisoTTS,这是一款开放权重的 80 亿参数文本转语音模型,通过文本和音频上下文进行条件化,生成富有表现力的语音。该模型利用残差向量量化 (RVQ) 在不增加参数数量的情况下扩展其声学范围,其灵感来自 Sesame CSM 架构。与 ElevenLabs 和 Sesame 等竞争对手相比,MisoTTS 的延迟显著降低,尽管其功能和声明需要进一步的第三方验证。

  3. TOOL · CL_69877 ·

    Miso Labs 构建开源 MisoTTS,用于富有表现力的本地语音 AI

    Miso Labs 正在开发 MisoTTS,一个开源语音 AI 模型。该模型专为富有表现力的语音、快速响应时间、语音克隆能力以及本地运行能力而设计。该公司认为,语音优先界面将是下一个主要的 AI 交互方式。

  4. TOOL · CL_67297 ·

    Miso Labs 发布了 80 亿参数的文本转语音模型

    Miso Labs 发布了 Miso-TTS,一个拥有 80 亿参数的文本转语音模型。该模型利用 Sesame CSM 架构,从文本和可选的音频上下文生成音频代码。它建立在一个大型的 Llama 3.2 风格骨干网络和一个较小的自回归音频解码器之上,能够实现高质量的对话语音和语音续写。