Anthropic 的 Frontier Red Team 进行了实验,让多个 AI 代理在同一个代码库上运行,结果显示,更新、更强大的模型并没有内在改善协调能力。相反,这些先进的模型通过近乎完全地拥有自己的文件,从而减少了代理间的冲突,取得了更好的成果。虽然旧模型会互相破坏,但像 Opus 4.8 和 Mythos Preview 这样的新模型通过最小化协作来改善了合并行为。研究还表明,代理群在漏洞挖掘等并行任务中很有效,但在顺序任务的效率方面则不然。 AI
影响 新的 AI 模型通过断言文件所有权来改善协调,这表明多代理系统架构发生了转变。
排序理由 Anthropic Frontier Red Team 发表的研究论文,详细介绍了多代理系统的实验。[lever_c_demoted from research: ic=1 ai=1.0]
- Anthropic
- Claude
- Claude Sonnet 4.6
- CrewAI Flows
- Frontier Red Team
- langgraph
- Mythos 5
- Mythos Preview
- Opus-4.6
- Opus 4.8
- Sonnet 5
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →