Fish.audio
PulseAugur coverage of Fish.audio — every cluster mentioning Fish.audio across labs, papers, and developer communities, ranked by signal.
- 2026-07-28 funding Fish Audio raised $50 million in seed funding led by Coreline Ventures and Capital Today. 来源
2 天有情绪数据
-
AI恶搞版《杰瑞·斯普林格秀》角色换成美少女战士
一位Reddit用户利用AI创作了一个《杰瑞·斯普林格秀》的视频恶搞,其中加入了《美少女战士》的角色。用户使用了Kinovi.ai和Fish.audio等工具来生成视频和观众反应,一些复杂的生成是在本地完成的。他们正在考虑继续用其他虚构关系进行《杰瑞·斯普林格秀》的恶搞系列。
-
Gradium推出文本提示词AI语音生成器
语音AI公司Gradium推出了Voice Design,这是一款根据文本描述生成合成语音的新工具。与传统的语音克隆不同,Voice Design不需要参考音频或说话者同意,允许用户在几秒钟内创建独特的语音。该工具支持多种语言,每次提示最多可提供五个语音候选。在盲听测试中,据报道Gradium的系统表现优于ElevenLabs等竞争对手,胜率为72.6%。
-
Fish Audio 实现 2100 万美元营收;Liquid AI 发布新的基准测试工具
Fish Audio 最初是一个 GitHub 上的业余项目,但已迅速发展成为一项盈利业务,一年内创造了 2100 万美元的年收入。与此同时,Liquid AI 发布了一个名为 Pipette 的开源工具。该工具旨在为 AI 模型提供更真实的性能基准测试,将 NVIDIA H100 服务器等高端系统的能力与智能手机硬件的实际限制进行对比。
-
教程:使用 Fish Audio 构建语音 AI 代理
本教程演示了如何使用 Fish Audio 构建语音 AI 代理。该过程包括设置必要的工具并进行配置,以创建能够进行语音交互的交互式 AI 代理。
-
Fish Audio 发布 S2.1 Pro 模型,延迟 90 毫秒,提供免费 API 访问
Fish Audio 推出了其 S2.1 Pro 模型,该模型具有 90 毫秒的延迟和对 83 种语言的支持。该公司还将在 2026 年前向开发者免费提供其旗舰 API。
-
Fish Audio 获 5000 万美元种子轮融资用于 AI 语音模型,服务 800 万用户
专注于 AI 语音模型的初创公司 Fish Audio 已获得 5000 万美元的种子轮融资。该公司提供开源和托管解决方案,拥有超过 15,000 个自然语言控制选项,可满足创作者和企业客户的需求。Fish Audio 目前拥有 800 万用户,年经常性收入为 2100 万美元。尽管过去曾因语音数据同意问题引发争议,此次融资将用于支持更先进的模型和企业功能的开发。
-
开发者将 5 个 TTS 模型集成到本地 CLI 工具 audio37 中
一位开发者创建了一个名为 audio37 的本地命令行界面工具,该工具集成了五个不同的文本转语音模型:Kokoro、Fish Audio、Chatterbox、Qwen 和 LuxTTS。该工具旨在为用户提供一个无需订阅、本地运行的文本转语音解决方案。
-
TTS模型对比:Qwen、Fish Audio、LuxTTS、Kokoro
对几款文本转语音(TTS)模型的比较突出了它们各自的独特功能。Fish Audio提供克隆和情感标签功能,而LuxTTS则以其小巧的体积和快速的克隆速度而著称。Qwen因其高质量的输出而受到认可,Kokoro则提供了广泛的54种预设。这些模型都可以通过一个命令行界面进行访问。
-
梅西、C罗、萨拉赫拓展足球以外的投资领域
几位顶级足球运动员正在将投资拓展到足球运动之外,其中莱昂内尔·梅西和克里斯蒂亚诺·罗纳尔多尤其专注于科技初创公司。梅西成立了Play Time HoldCo,一家投资于人工智能、媒体和科技公司的投资公司,其投资组合包括FieldAI和SuperAnnotate。相比之下,C罗主要将投资集中在健康科技领域。然而,穆罕默德·萨拉赫则采取了不同的策略,专注于传统的商业合作、房地产和慈善事业。