Granite 4.0 1B 模型在多项基准测试中展示了性能指标,包括 GPQA 为 28.1%,MMLU-Pro 为 32.5%,HLE 为 4.8%,长上下文为 6%。这些结果是独立测量的,而非自报,为该尺寸模型的性能提供了透明的视图。 AI
影响 为 1B 参数模型提供了独立的性能数据,有助于开发者的比较分析。
排序理由 该集群报告了一个开源模型的基准测试结果,属于研究范畴。[lever_c_demoted from research: ic=1 ai=1.0]
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →