实体
clawbench
clawbench
PulseAugur coverage of clawbench — every cluster mentioning clawbench across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
Mach-Mind-4-Flash:35B MoE 模型性能媲美 100B+ 模型
研究人员推出了 Mach-Mind-4-Flash,这是一个拥有 350 亿参数的专家混合(MoE)模型,但仅激活 30 亿参数。通过训练后优化,该模型实现了与 1000 亿参数模型相当或更优的性能。该系统采用三阶段流程,包括统一的 RL/OPD 训练基础设施、通过多教师在线策略蒸馏融合的领域特定 RL 专家,以及用于压缩推理链的混合中位数长度策略优化。
-
Qwen 3.6 在 clawbench 基准测试中声称表现最佳
根据该基准测试创建者的社交媒体帖子,Qwen 3.6 已在 clawbench 基准测试中展现出最佳性能。此公告强调了该模型在特定评估中的强大能力,将其定位在最新的大型语言模型竞争格局中。