Anthropic 发布了 Claude Opus 5,保持与 Opus 4.8 相同的定价,同时显著提高了在代理编码基准测试上的性能。这款新模型提供的能力接近 Fable 5,但成本却大大降低,可能使其成为复杂任务的默认选择。然而,此次发布包含两项重大的 API 变更:自适应思维现在默认启用,这可能会截断响应;禁用思维的特定配置将导致错误。 AI
影响 树立了新的价格性能标准,可能降低在复杂任务上升级到高端模型的必要性。
排序理由 前沿实验室模型发布,包含系统卡和基准测试数据。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
- Amazon Bedrock
- Anthropic
- Claude API
- Claude Opus 5
- CursorBench 3.2
- Frontier-Bench v0.1
- Google.Cloud
- Microsoft Foundry
- Opus 4.8
- OSWorld 2.0
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →