一款名为 Fiorillo v0.5 的新开源模型已发布,旨在以概率输出来回答有关随机试验的问题。该模型基于 Qwen3-4B-Base,并添加了适配器和决策头,在允许重新使用的许可文章上进行了微调。Fiorillo v0.5 在 Evidence Inference 2.0 基准测试中取得了强劲表现,达到了预先注册的准确性和校准标准,并且在对数损失方面优于 Gemma 4 31B-it。 AI
影响 此次发布提供了一个专门用于分析随机试验的开源工具,有望提高研究的可复现性和数据提取能力。
排序理由 该条目描述了一篇研究论文,其中详细介绍了一个新的开源模型及其在特定基准测试上的表现。[lever_c_demoted from research: ic=1 ai=1.0]
- Apache Software License 2.0
- arXiv
- Evidence Inference 2.0
- Fiorillo v0.5
- Gemma 4 31B-it
- Hugging Face
- Open Science Framework
- Qwen3-4B-Base
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →