实体
MXFP6
MXFP6
PulseAugur coverage of MXFP6 — every cluster mentioning MXFP6 across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天
2 天有情绪数据
最近 · 第 1/1 页 · 共 3 条
-
Karpathy 提倡 STEM 教育;AMD 新 GPU 规格揭晓
Andrej Karpathy 建议 80% 的教育应专注于数学、物理和计算机科学,暗示传统教育对未来几代人可能不太重要。另外,AMD MI4555X GPU 因其有前景的规格而受到关注,包括 40 Petaflops 的性能和 432 GB 的 RAM 以及可观的带宽,并利用 MXFP6 提高精度。
-
DynamiQ框架通过优化的梯度同步加速LLM训练
研究人员开发了DynamiQ,一个旨在通过优化梯度同步来加速大型语言模型训练的新框架。该方法通过采用新颖的部分和表示技术以及用于高效执行的融合内核,解决了大规模模型训练中的网络瓶颈问题。DynamiQ已展示出显著的改进,与现有最先进的方法相比,速度提升高达34.2%,同时保持接近基线的准确性。
-
新工具通过先进的 NVFP4/MXFP6 量化优化 llama.cpp 模型
一位开发者发布了一款先进的 llama.cpp 量化工具,旨在创建 NVFP4 和 MXFP6 GGUF 模型。该工具超越了基础量化,通过评估各种方法并结合 RSF(精炼尺度拟合)等自定义技术来优化模型性能。它使用困惑度(perplexity)和 KLD 等指标对层进行单独评分,同时保守处理敏感张量,并在合理时将其提升到更高的精度。该项目还包括一个用于 NVIDIA Blackwell 架构的新 MXFP6 CUDA 实现。