PulseAugur
中
实时 01:30:36
实体 Qwen3.6-27B-Fable-Fusion

Qwen3.6-27B-Fable-Fusion

PulseAugur coverage of Qwen3.6-27B-Fable-Fusion — every cluster mentioning Qwen3.6-27B-Fable-Fusion across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_176015 ·

    llama.cpp PR 缓存 MoE 专家以加速本地 AI 推理 · 跟踪 4 个来源

    llama.cpp 的一项新拉取请求引入了一种在 GPU 上缓存常用专家混合(MoE)层的方法,通过将 Qwen3.6-35B-A3B 等模型在显存有限的消费级硬件上的推理速度最高提升 2 倍。然而,这种优化并非普遍适用,由于开销原因,在某些情况下甚至可能降低性能。同时,llama.cpp 还迎来了其他更新,包括增强了对 Intel GPU 的 SYCL 支持,改进了 iGPU 和 WebGPU F16 性能,并为聊天模型引入了工具调…