实体
MOD St Athan
MOD St Athan
PulseAugur coverage of MOD St Athan — every cluster mentioning MOD St Athan across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
AI 模型超越单设备,引发关于比特精度的争论
关于 AI 模型开发的讨论强调了日益增长的硬件需求以及 LLM 中降低精度的可能性。一位用户指出,最新的模型,接近 30 亿参数,超出了单个设备的容量,导致暂停购买高端 NVIDIA DGX 系统。同时,另一位用户质疑像 Kimi k3 这样的 1 比特 LLM 的实用性,并将其与标准的 8 或 16 比特模型进行对比,认为它在数学上是不可靠的。
-
DeepSeek V4-Flash 在双DGX Sparks上达到40 Ttk/s
一位用户分享了在双DGX Sparks硬件上运行DeepSeek V4-Flash模型的配置和基准测试。该设置在FP8精度下实现了约每秒40万亿token(tera-tokens per second)的吞吐量,并在处理具有256k上下文窗口的多个请求时,聚合吞吐量可达每秒350万亿token。此性能与Nvidia RTX Pro 6000和Mac M2 Ultra系统进行了比较,突显了双DGX设置在大模型推理方面的效率。