InsForge 更新了其 MCPMark 基准测试结果,现使用 Anthropic 的 Claude Sonnet 4.6。该基准测试在 21 项真实数据库任务上比较 InsForge 的 MCP 层与 Supabase 的 MCP 层,结果显示 InsForge 在准确性和令牌效率方面保持领先。使用 Claude Sonnet 4.6,InsForge 实现了 28% 的更高 Pass⁴ 准确率,并使用了比 Supabase MCP 少 2.4 倍的令牌,从而扩大了与先前测试相比的效率差距。 AI
影响 强调了结构化后端上下文对于 LLM 代理日益增长的重要性,因为更强大的模型放大了不提供上下文的成本。
排序理由 使用新模型版本更新了比较两个 MCP 层的基准测试结果。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →