Kimi K2.7 Code 在 GPQA 基准测试中取得了 89.6% 的分数,处理速度为每秒 40.5 个令牌。该模型的一个关键亮点是其效率,表现为每美元获得 25.1 个智能点数。 AI
影响 展示了在学术基准测试中改进的效率和性能,可能影响未来的模型开发。
排序理由 该条目报告了 AI 模型的基准测试性能。 [lever_c_demoted from research: ic=1 ai=1.0]
在 Mastodon — fosstodon.org 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →