PulseAugur
实时 09:26:42
实体 DeepSeek-R1-Distill-Qwen-32B

DeepSeek-R1-Distill-Qwen-32B

PulseAugur coverage of DeepSeek-R1-Distill-Qwen-32B — every cluster mentioning DeepSeek-R1-Distill-Qwen-32B across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_191141 ·

    大型语言模型在复杂规划任务中难以维持内部世界模型

    研究人员调查了大型语言模型为何在汉诺塔等规划谜题上遇到困难,特别是初始状态和目标状态复杂的变体。通过在预先计算好的解决方案上训练较小的 Transformer 模型,他们发现这些模型会发展出对谜题状态空间的一种涌现的“世界模型”,这对解决问题至关重要。然而,当将此应用于 Qwen3.6-27B 和 DeepSeek-R1-Distill-Qwen-32B 等更大的模型时,研究表明,虽然这些模型编码了类似的世界模型,但由于在规划过程中该…

  2. RESEARCH · CL_10089 ·

    新的分支合并蒸馏方法创造了更小、高精度的LLM

    研究人员开发了一种名为分支合并蒸馏的新方法,用于创建更小、高性能的大型语言模型。该方法涉及将知识从大型教师模型选择性地蒸馏到专门的学生模型中,然后将这些模型合并以提高泛化能力。结果模型TinyR1-32B-Preview在数学、编码和科学基准测试中,其准确性优于其蒸馏版本,同时在特定数学测试中的表现几乎与教师模型相当。