Jebadiah v2.1,一套新的开放权重模型,已发布 27B 和 9B 参数版本。这些模型旨在将决策视为一个封闭集评分问题,而不是文本生成,从而从 logits 中为每个允许的标签评分。v2.1 更新在决策指数基准测试中显示出改进的性能,特别是在知识、语言和检索任务方面,尽管在工具使用能力方面注意到了一次回归。 AI
影响 为决策评分任务提供了新的开放权重模型,并提供了基准测试结果和代码以供进一步研究。
排序理由 发布了具有基准测试结果和代码的开放权重模型。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →