Mistral AI 发布了 Mistral Large 4,一个拥有 1.05 万亿参数的新模型,使其成为开放权重模型领域的有力竞争者。该模型在网络安全基准测试中表现出色,在 AA Cyber Index 上达到 82%,尽管像 Claude Opus 5.5 和 GPT-6 Astra 这样的闭源模型据称拒绝完成此特定任务。虽然 Large 4 在多语言能力方面展现出潜力并提供有竞争力的价格,但在人类评估的编码任务方面略逊于 Claude Opus 5。 AI
影响 为开放权重模型树立了新标杆,尤其是在网络安全领域,并为闭源模型提供了有竞争力的替代方案。
排序理由 前沿实验室模型发布,附带系统卡和性能基准测试。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
- Artificial Analysis Cyber Index
- Beam
- Claude Opus 5.5
- DeepSeek
- General Language Model
- GPT-6 Astra
- Le Chonk
- Mistral AI
- Mistral Large 4
- Nvidia Grace Blackwell
- Qwen
- Reflection
- Surge AI
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →