实体
qwen35moe
qwen35moe
PulseAugur coverage of qwen35moe — every cluster mentioning qwen35moe across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
llama.cpp b11477 优化了跨模型的张量标志共享
llama.cpp 项目发布了 b11477 版本,该版本引入了跨不同模型处理张量标志的优化。此次更新将仅限 trunk 和仅限 MTP 模型的检测逻辑集中到 llama_model_base 中的一个辅助函数。此外,包括 DeepSeek4、nemotron-h、Qwen35、qwen35moe、qwen3next 和 qwen4exp 在内的多个模型现在支持仅限 trunk 文件,增强了兼容性和效率。
-
llama.cpp 现在默认加载 MTP 张量,增加了资源使用量
流行的开源推理引擎 llama.cpp 已更新其默认行为,以自动加载多令牌预测 (MTP) 张量。此更改会影响内置 MTP 张量的模型,例如 GLM-5.2、hy_v3、qwen35moe 和 step35。以前,只有在明确启用推测解码时才会加载这些张量。现在,它们将默认加载,即使您不使用 MTP 功能,也可能会增加用户的 VRAM 和 RAM 使用量。