一个名为 autotrust/GLM5.3-Flash-E224-DGX-Spark 的 zai-org/GLM-5.3-Flash 模型非官方衍生版本,专为 NVIDIA DGX Spark 等桌面 Blackwell 系统开发。该优化版本保留了原模型相当一部分的专家,同时利用 NVFP4 提高效率,使其能够容纳在两个 DGX Spark 或单个 180 GB Blackwell GPU 的内存限制内。该模型保留了原模型完整的词汇表和视觉能力,基准测试表明其性能接近未剪枝版本,但由于内存带宽的降低,预计在 DGX Spark 上的吞吐量会较低。 AI
影响 使得在桌面级硬件上运行大型模型成为可能,可能提高研究人员和开发者的可及性。
排序理由 这是一个衍生模型发布,而非来自前沿实验室的主要发布。
在 Hugging Face Trending Models 阅读 →
- autotrust/GLM5.3-Flash-E224-DGX-Spark
- ConnectX-7
- GB100
- Nvidia
- Nvidia B200
- NVIDIA DGX Spark
- NVIDIA GB10 Grace Blackwell Superchip
- vLLM
- zai-org/GLM-5.3-Flash
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →