实体
Qwen 3.5/3.6
Qwen 3.5/3.6
PulseAugur coverage of Qwen 3.5/3.6 — every cluster mentioning Qwen 3.5/3.6 across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
mistral.rs v0.9.0 的 CPU 解码速度比 llama.cpp 快 1.8 倍
mistral.rs 项目已发布 0.9.0 版本,在大型语言模型的 CPU 解码方面展示了显著的性能提升。基准测试显示,在 x86 和 ARM 架构上,mistral.rs 的速度比 llama.cpp 快 1.8 倍。这些优化旨在惠及所有模型,并适用于包括支持 AVX2、AVX512 和 NEON 的各种 CPU。
-
DeepSeek V4 Flash 模型在 llama.cpp 中获得早期支持
一个拉取请求正在进行中,旨在将 DeepSeek V4 Flash 模型添加到 llama.cpp 库中。尽管目前处于早期、缓慢且不稳定的阶段,但该模型因其相对于其大小的智能而受到赞扬,使其能够与前沿模型相媲美。它对量化和上下文窗口缩放的高效处理也使其非常适合本地推理,有可能主导 80-140GB 模型领域。