PulseAugur
实时 09:56:11
实体 MiMo-7B-SFT

MiMo-7B-SFT

PulseAugur coverage of MiMo-7B-SFT — every cluster mentioning MiMo-7B-SFT across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_257050 ·

    GrowMTP在RL循环中训练草稿头,加速LLM训练

    研究人员开发了GrowMTP,一种在强化学习(RL)循环内完全训练用于推测性解码的草稿头的新颖方法。这种方法无需单独预训练草稿头,从而降低了训练成本。GrowMTP利用RL训练期间产生的窄回滚分布和连续监督信号来优化草稿头。在Qwen3-4B、MiMo-7B-SFT和Qwen3.5-4B-Base模型上的实验表明,回滚生成和端到端训练时间均显著加快。