一款基于拥有1.35亿参数的SmoLLM骨干模型的新语音模型已被开发出来,旨在促进自然的全双工对话。该模型实现了令人印象深刻的80毫秒延迟,能够实现流畅的回复和自然的语道反馈,从而显著增强了对话的流畅性。虽然目前的概念验证使用了较小的骨干模型,但计划在未来开发更大的版本。 AI
影响 该模型可以显著提高AI驱动的对话代理的响应速度和自然度。
排序理由 该集群描述了一个具有技术细节和性能指标的新模型发布,符合研究类别。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →