PulseAugur
实时 13:44:59
English(EN) DFM Mimir v1: An Open HRM Delivering Frontier Performance at 1B Parameters Using Only Permissible Post-Training Data

DFM Mimir v1:一个在道德数据上训练的 1B 参数模型达到了丹麦的 SOTA

一个名为 Mimir v1 的新型 10 亿参数语言模型已被开发出来,它采用了分层推理模型 (HRM) 架构。该模型值得注意的是,它仅在允许的数据上进行训练,在丹麦语性能上达到了新的技术水平,同时在英语方面也保持了竞争力。Mimir v1 在 161 个数据集的混合体上进行了训练,其性能与 Qwen 3.5-4BGemma 4-E2B 等更大模型相当。 AI

影响 证明了道德数据来源可以产生具有竞争力的 LLM 性能,可能降低开源开发的门槛。

排序理由 该集群描述了一篇详细介绍新型语言模型架构及其性能的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]

在 Hugging Face Daily Papers 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

DFM Mimir v1:一个在道德数据上训练的 1B 参数模型达到了丹麦的 SOTA

报道来源 [1]

  1. Hugging Face Daily Papers TIER_1 English(EN) ·

    DFM Mimir v1:一款开放式 HRM,以 10 亿参数实现前沿性能,仅使用允许的训练后数据

    Mimir v1 is a 1-billion-parameter Hierarchical Reasoning Model trained solely on permissible data that achieves competitive English results and state-of-the-art Danish performance across multiple benchmarks.