一款名为Tiel-Coder-35B-A3B的新型开源模型已发布,该模型针对编码任务和长对话进行了优化。它在SWE-bench-Live基准测试中取得了强劲的性能,修复了25个问题中的12个,这与Anthropic的Opus 4.6中型模型相当。虽然Tiel在编码和多轮对话方面表现出色,但在琐事和常识任务方面能力较弱,在MMLU-Pro上的得分低于同类其他模型。 AI
影响 为代理编码和长对话任务提供了一个新的开源选项,有可能提高开发人员的生产力。
排序理由 发布了一款具有基准性能数据的新型开源模型。[lever_c_demoted from research: ic=1 ai=1.0]
在 Hugging Face Trending Models 阅读 →
- Claw-Eval
- MMLU-Pro
- Opus 4.6
- Ornith-1.5-35B-A3B
- Qwen3.6-35B-A3B
- Qwen3.8-27B
- Sonnet 5
- SWE-bench-Live
- Tiel-Coder-35B-A3B
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →