一项新的基准研究 RankEvolve 表明,使用一系列不同的编码代理可以显著提高可执行准确性,这比使用同一代理的多个实例效果更好。Meta 进行的研究在 Claude Code 和 Codex 等代码库上测试了各种代理组合,发现异构方法,例如先使用 Claude Code 再使用 Codex,可以达到 62.5% 的执行准确率。相比之下,重复使用同一代理或简单的 N 选一基线方法准确率要低得多,这凸显了不同代理能力的优势。 AI
影响 证明了不同的 AI 代理组合可以优于同质化组合,这可能指导未来更有效的 AI 编码助手开发。
排序理由 该条目描述了一项基准研究及其对编码代理的发现,属于研究范畴。[lever_c_demoted from research: ic=1 ai=1.0]
- Claude Code
- Claude Opus 4.8
- codex
- ExecML
- GPT-5.6
- Hajee Mohammad Danesh Science & Technology University
- LitGPT
- Meta
- Python
- PyTorch
- RankEvolve
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →