Inception Labs 推出了 Mercury 2.5,这是一款在 NVIDIA GPU 上实现每秒 1,107 个 token 的扩散式语言模型。与像 GPT-3 这样逐个 token 生成文本的传统自回归模型相比,这代表了显著的速度提升。Mercury 2.5 采用扩散生成过程,类似于 Stable Diffusion 等图像生成模型,允许对整个输出进行并行优化,而不是顺序预测 token。该公司声称,这种方法比其前身 Mercury 2 提供了 40% 的智能提升,并提供了一个可调的 AI
影响 这种基于扩散的方法可以显著加快 LLM 的推理速度,可能催生新的实时应用。
排序理由 该条目描述了一个实验室(Inception Labs)发布的新模型,并附有具体名称和性能指标。[lever_c_从 frontier_release 降级:ic=1 ai=1.0]
- Artificial Analysis
- Claude Haiku-4-5
- Gemini 3.8 Flash
- GPT-3
- Inception Labs
- Mercury 2
- Mercury 2.5
- Nvidia
- Stable Diffusion
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →