Inception Labs 发布了 Mercury 2.5,这是一款新的扩散式大语言模型,其智能水平比前代 Mercury 2 提高了 40%。该模型在 NVIDIA GPU 上实现了每秒 1,107 个 token 的惊人速度,并支持 260K token 的上下文窗口。Mercury 2.5 定位为具有成本效益的替代方案,可与 GPT-5.6 Luna (Low) 和 Gemini 3.5 Flash-Lite 等模型相媲美,并且初始定价大幅降低。此次发布还包括 Mercury Voice 和 Mercury Router 的预览版,旨在进一步优化对延迟敏感的应用和智能模型路由。 AI
影响 在智能、速度和成本效益方面为扩散式大语言模型树立了新标杆,可能对搜索、语音和编码应用产生影响。
排序理由 来自前沿实验室(Inception Labs)的新模型发布,具有性能指标并与其他前沿模型进行了比较。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
在 Hacker News — AI stories ≥50 points 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →