研究人员开发了 RefactorPlatform,这是一个开源工具,旨在评估 AI 代理在大型代码重构任务中的性能。该平台标准化了评估环境,允许对不同的设计选择进行可控比较,包括像 GitHub Copilot CLI 和 OpenRouter 这样的模型主干、各种执行策略和提示变体。对 100 个多文件任务进行的初步测试表明,与朴素的令牌窗口分块相比,AST 感知分块将准确性提高了 25-30%,并且单个检索增强代理的表现优于多代理委托方法。 AI
影响 实现了 AI 代码重构代理的可复现评估,有望加速其开发并提高其可靠性。
排序理由 该集群描述了一个新的开源研究平台及其初步评估结果,发布在 arXiv 上。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- arXiv
- CatalyzeX Code Finder for Papers
- CORE Recommender
- DagsHub
- GitHub Copilot CLI
- Gotit.pub
- Hugging Face
- Influence Flower
- OpenRouter
- RefactorBench
- RefactorPlatform
- ScienceCast
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →