OmnisRouter 的开发者分享了基准测试结果,该工具旨在将 LLM 请求路由到成本最有效的模型,但其排名接近底部。尽管测试设置存在初始错误,但修正后的 OmnisRouter 在 RouterArena 上达到了 72.7% 的准确率,每千次查询成本为 3.71 美元。与使用更便宜的开源模型的其他路由器相比,其高昂的成本使其排名第 16 位(共 18 个路由器)。 AI
影响 此基准测试突显了在路由到高级 LLM 时成本与性能之间的权衡,表明当前的基准测试可能无法反映真实的代理使用情况。
排序理由 该条目详细介绍了特定 LLM 路由工具在独立基准测试中的表现。
- Claude Code
- Claude (Haiku)
- cross-router
- GPT-5
- GPT-5 nano
- hybrid-router
- ICLR 2026
- MMLU-Pro
- OmnisRouter
- Opus
- Paix2-router
- RouterArena
- sqwish-router
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →