由韩国初创公司VIDRAFT开发的名为Darwin-180B-RSI的开放权重180B模型,在法律推理基准测试中取得了最高排名,尽管它从未接受过法律数据训练。该模型采用了一种名为模型级递归自我改进(RSI)的新颖方法,通过解决练习题来学习,然后仅在自己的正确答案上进行训练。这种方法似乎培养了一种通用的推理能力,可以迁移到新领域,正如其在瑞士法律考试中相对于GPT-5、Claude-4.5-Sonnet和Gemini 2.5 Pro等领先模型的优异表现所证明的那样。 AI
影响 证明了通用推理技能可以在没有领域特定数据的情况下进行训练,有可能加速人工智能在新领域的适应。
排序理由 该条目详细介绍了一种新颖的人工智能模型训练方法及其在特定基准测试上的表现,与研究发现一致。[lever_c_demoted from research: ic=1 ai=1.0]
- Claude-4.5-Sonnet
- Darwin-180B-RSI
- DeepSeek
- ETH Zurich
- Gemini 2.5 Pro
- GPT-5
- Hugging Face
- LEXam-hard
- Max Planck Institute
- Moonshot AI
- University of Zurich
- VIDRAFT
- Xiaomi
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →