实体
Qwen3-30B-A3B-Base
Qwen3-30B-A3B-Base
PulseAugur coverage of Qwen3-30B-A3B-Base — every cluster mentioning Qwen3-30B-A3B-Base across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
多领域强化学习新研究 · 追踪10个来源
arXiv上发表的多篇研究论文探讨了强化学习(RL)的进展及其应用。一项研究侧重于通过决策树剪枝提高RL策略的可解释性,并在控制基准测试中显示出有效性。另一篇论文介绍了一种博弈论逆强化学习方法,用于预测人类驾驶行为,其准确性优于现有方法。此外,研究还探讨了可解释人工智能(XAI)在人机协作中的支持作用、RL组件在样本高效控制中的协同作用,以及多目标RL的网络现代化。其他论文深入研究了轨迹相对滞后蒸馏、信用节约动作到令牌分配,以及在模拟…
-
新方法追踪稀疏 MoE 语言模型中的事实回忆
研究人员开发了一种新的“专家感知因果追踪”方法,专门用于稀疏专家混合(MoE)语言模型。该技术旨在精确定位 MoE 块中负责事实回忆的具体“专家”。研究将此方法应用于 Qwen3-30B-A3B-Base 和 Mixtral-8x7B-v0.1 等模型,发现专家定位可能依赖于模型。