PulseAugur
实时 16:52:01

Poolside 发布 Laguna M.1,一款用于代理编码的 225B MoE 模型

Poolside 发布了 Laguna M.1,这是一款拥有 2250 亿参数的混合专家(MoE)模型,专为代理编码任务进行了优化。该模型采用了具有 256 个专家的稀疏 MoE 架构和全局注意力机制,使其能够处理长时程工作和带有工具调用的交错推理。Laguna M.1 在 SWE-bench VerifiedTerminal-Bench 2.0 等代理基准测试中表现出色,可与其他领先的开放权重模型和前沿模型相媲美。该模型在 Apache 2.0 许可下可用,并在各种推理框架中得到支持。 AI

影响 在代理编码基准测试中设定了新的 SOTA(State-of-the-Art),可能加速 AI 代理的开发。

排序理由 Frontier-lab 模型发布,带有系统卡 [lever_c_demoted from frontier_release: ic=2 ai=1.0]

在 r/LocalLLaMA 阅读 →

AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →

Poolside 发布 Laguna M.1,一款用于代理编码的 225B MoE 模型

报道来源 [2]

  1. Hugging Face Trending Models TIER_1 (ET) · poolside ·

    poolside/Laguna-M.1

    text-generation · 325 downloads · 52 likes

  2. r/LocalLLaMA TIER_1 (TL) · /u/pmttyji ·

    poolside/Laguna-M.1 · Hugging Face - 225B-A23B

    <table> <tr><td> <a href="https://www.reddit.com/r/LocalLLaMA/comments/1u9b2i3/poolsidelagunam1_hugging_face_225ba23b/"> <img alt="poolside/Laguna-M.1 · Hugging Face - 225B-A23B" src="https://external-preview.redd.it/vHCU5AFU0BwrXZl0c0jt_f_O2yQ-jV1nc7SNtokYWKU.png?width=640&amp;c…