Solar Pro 4 在 GPQA 基准测试中取得了 89.1% 的分数,在研究生水平的问答方面表现强劲。该模型还展示了每秒 59.1 个 token 的效率,每美元获得 62.3 个智能点,表明速度和成本效益取得了良好的平衡。这些结果是独立测量的,可与其他模型进行比较。 AI
影响 展示了研究生水平问答能力的性能和效率的提高,可能影响未来的模型开发。
排序理由 该项目报告了 AI 模型的基准测试结果,属于研究范畴。[lever_c_从研究降级:ic=1 ai=1.0]
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →