实体
@sudoingX
@sudoingX
PulseAugur coverage of @sudoingX — every cluster mentioning @sudoingX across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
124B 模型在单台 DGX Spark 上实现 38.7 tok/s,性能优于 DeepSeek V4 Flash
一位名为 sudoingX 的用户在一台 DGX Spark 上对一个拥有 124B 参数的模型进行了基准测试,在优化的 INT4 路径上实现了每秒 38.7 个 token 的速度。该性能被发现比在同一硬件上运行的 DeepSeek V4 Flash 快 2.4 倍。用户最初报告了在单台 Spark 上使用官方量化版本时遇到的问题,但后来纠正了这一点,确认这是他们最快的选项。
-
Google 发布 Gemma 4 检查点以实现高效 AI 训练
Google 在 Hugging Face 上发布了针对量化感知训练 (QAT) 优化的 Gemma 4 检查点。这一进步使得模型部署更加高效,而这在一年前单块消费级 GPU 上是不可能实现的。这一发展标志着让先进的 AI 模型在标准硬件上更易于访问和更具性能的重大飞跃。