Inception Labs 发布了 Mercury 2.5,这是一款基于扩散式语言模型,在速度和成本效率方面显著优于传统的自回归模型。与传统的逐个 token 生成不同,Mercury 2.5 并行优化输出,速度比典型的前沿模型快 5-20 倍,同时保持了可比的质量。这种速度优势已在 AI 电话代理和上下文压缩等领域得到实际应用,并有可能将大语言模型市场细分为专业化、高性价比的工具。 AI
影响 加速专业化、高性价比的大语言模型在生产工作负载中的应用,尤其是在对延迟敏感的应用中。
排序理由 前沿实验室模型发布,附带系统卡 [lever_c_demoted from frontier_release: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →