GLM-4.7-Flash 模型在多个基准测试中展示了特定的性能指标,包括 GPQA、人类最后考试、长上下文推理和 SciCode。该模型在 GPQA 上达到 45.2%,在 SciCode 上达到 25.5%。此外,它每秒处理 179.6 个 token,每美元达到 101.3 智能点,显示了其效率。 AI
影响 为 GLM-4.7-Flash 模型在关键基准测试中的具体性能数据提供了信息,有助于进行比较分析。
排序理由 该条目报告了 AI 模型的基准测试结果,属于研究范畴。[lever_c_从研究降级:ic=1 ai=1.0]
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →