Anthropic 发布了 Claude Haiku 5.5,这是一个重要的升级版本,具有增强的运营能力和自适应推理。新模型在计算机操作、知识工作和多学科推理方面显示出显著的改进,基准测试表明其性能相比前代产品有了显著飞跃。尽管取得了这些进步,Haiku 5.5 在复杂的编程任务方面仍落后于 Sonnet 5.5 等更高级别的模型。此次更新还引入了更灵活的定价结构,对超过 100,000 个 token 的上下文窗口实行分级收费,并采用了一种新的分词器,这可能会改变现有内容的 token 数量。 AI
影响 增强了子代理任务的运营效率,并为长上下文场景提供了更灵活的定价。
排序理由 Frontier-lab 模型发布,附带系统卡。[lever_c_demoted from frontier_release: ic=2 ai=1.0]
- AA-Briefcase v1.1
- Anthropic
- Claude Haiku 5.5
- FrontierCode 1.1
- GDPval-AA v2.1
- GPT-6.1 Sol
- Haiku 4.5
- Humanity's Last Exam
- OpenAI
- Opus 5.5
- OSWorld 2.1
- Sonnet 5.5
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →