一款新的开源模型 SuperDeepseek-V4-Flash 已发布,能够运行在 128-256 GB 的显存上,并取得了令人印象深刻的性能指标。该模型据称可以修复损坏的权重,并提供具有 1M 上下文窗口的改进通用智能,在双 DGX Spark 设置上速度高达 129 tokens/sec。另外,VITAGroupUT 的一项研究探讨了智能体扩展,表明仅靠模型扩展并非智能体改进的唯一驱动因素。他们的工作 StateM 在 Terminal-Bench 2.1 上取得了高准确率,甚至在与智能体操作结合以实现更好的工作流控制时,其表现优于一些前沿模型。 AI
影响 强调了开源模型能力的进步以及对人工智能智能体开发传统方法的挑战。
排序理由 该集群包含模型发布和讨论智能体扩展的研究论文。
在 Mastodon — fosstodon.org 阅读 →
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →