实体
jlnsrk/GLM-5.2-colibri-int4
jlnsrk/GLM-5.2-colibri-int4
PulseAugur coverage of jlnsrk/GLM-5.2-colibri-int4 — every cluster mentioning jlnsrk/GLM-5.2-colibri-int4 across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
时间线
- 2026-07-06 product_launch A quantized version of the GLM-5.2 model, jlnsrk/GLM-5.2-colibri-int4, was released on Hugging Face. 来源
最近 · 第 1/1 页 · 共 2 条
-
GLM-5.2 模型通过 colibri 引擎更新以实现更快的推理速度
Hugging Face 上发布了 GLM-5.2 模型的新版本,名为“colibri int4 with int8 mtp”。此版本基于原始 GLM-5.2 模型,并采用了 int8 MTP 头部,旨在通过推测性解码显著提高推理速度。该模型需要 colibri 引擎才能运行,并且与 GGUF 或 AWQ 等标准格式不兼容。它在 MIT 许可下分发。
-
GLM-5.2 模型通过 Colibri 引擎实现量化,可在消费级硬件上运行
GLM-5.2 模型的一个量化版本,名为 jlnsrk/GLM-5.2-colibri-int4,已在 Hugging Face 上发布。该版本通过从磁盘流式传输专家,旨在在消费级硬件上运行,需要大约 25 GB 的 RAM 和 400 GB 的快速本地存储。该模型使用自定义容器格式,仅与 Colibri 引擎兼容,不支持 GGUF 或 GPTQ 等标准格式。