Poolside 发布了 Laguna M.1,这是一款拥有 2250 亿参数的混合专家(MoE)模型,专为代理编码任务进行了优化。该模型采用了具有 256 个专家的稀疏 MoE 架构和全局注意力机制,使其能够处理长时程工作和带有工具调用的交错推理。Laguna M.1 在 SWE-bench Verified 和 Terminal-Bench 2.0 等代理基准测试中表现出色,可与其他领先的开放权重模型和前沿模型相媲美。该模型在 Apache 2.0 许可下可用,并在各种推理框架中得到支持。 AI
影响 在代理编码基准测试中设定了新的 SOTA(State-of-the-Art),可能加速 AI 代理的开发。
排序理由 Frontier-lab 模型发布,带有系统卡 [lever_c_demoted from frontier_release: ic=2 ai=1.0]
- Claude Sonnet 4.6
- DeepSeek-V4 Flash
- Devstral 2
- GLM-4.7
- Hugging Face
- poolside/Laguna-M.1
- Qwen3.5-397B-A17B
- SWE-bench Multilingual
- SWE-Bench Pro
- SWE-bench Verified
- Terminal-Bench 2.0
- Apache Software License 2.0
- Laguna M.1
- Mixture-of-Experts
- Muon
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →