实体
IQ4_XS
IQ4_XS
PulseAugur coverage of IQ4_XS — every cluster mentioning IQ4_XS across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
Qwen3.8-27B 模型获得 IQ4_XS 新量化,适用于 16GB 内存
一位用户分享了 Qwen3.8-27B 模型的新量化方法,名为 IQ4_XS。此量化旨在兼容拥有 16GB 内存的系统,从而使硬件配置较低的用户也能使用该模型。帖子中包含指向 Hugging Face 上量化模型的链接。
-
阿里巴巴的Qwen 3.6 27B在本地编码时推理速度提升2.5倍
阿里巴巴的Qwen 3.6 27B模型已更新,提供显著更快的推理速度,通过多Token预测(MTP)实现了2.5倍的提升。这一增强功能允许在具有高达262K上下文窗口的本地Agentic编码中实现高效运行,即使在仅有48GB VRAM的硬件上也能实现。此外,基准测试突出了各种量化级别的性能,其中IQ4_XS在16GB VRAM上展示了98%的BF16准确率,使其成为资源受限环境下的实用选择。