AMD MI355X
PulseAugur coverage of AMD MI355X — every cluster mentioning AMD MI355X across labs, papers, and developer communities, ranked by signal.
2 天有情绪数据
-
AMD MI355X 内核优化显示性能提升 4 倍,但仍落后于竞争对手
AMD 和 GPU_MODE 社区最近组织的一次内核黑客马拉松,显著提升了 AMD MI355X 显卡的性能。据报道,Readonflow Team 的优化内核将 MI355X 的端到端上游性能提升了四倍多。尽管这一进展显示出希望,但 AMD 在 Kimi 模型上的 vLLM 性能仍落后于竞争对手,不过预计未来会有改进。
-
MiniMax AI 通过 AMD MI355X 优化,性能接近 NVIDIA B200
MiniMax AI 利用 AMD 的 MI355X 硬件,在其 Minimax M3 模型上实现了接近 NVIDIA B200 的性能。这一进展得益于 AMD 的 ATOM 和 ATOMesh 技术的全栈协同优化,具体细节已在近期技术博客中披露。此次优化特别有利于 MiniMax 的 428B MSA 稀疏 MoE 多模态基础模型,并采用了 EAGLE3 投机解码等技术以提高生成效率。
-
新AI模型Leanstral 1.5发布;AMD MI355X大幅降低AI计算成本
名为Leanstral 1.5的新AI模型已发布,声称通过其先进的功能带来丰富和革命性的行业变革。另外,使用AMD MI355X的AI计算进步据报道比Blackwell的成本低2倍,可能使AI更容易获得并促进创新。
-
GLM5.2 部署在 AMD MI355X 上以实现更便宜的推理 · 已追踪 5 个来源
Wafer.ai 已成功将 GLM5.2 部署在 AMD MI355X 硬件上,实现了 2626 tokens/秒/节点 的吞吐量和 213 tokens/秒 的单流推理速度。此次部署具有成本优势,MI355X GPU 的成本大约比 NVIDIA 的 Blackwell B300 低 2.75 倍。优化工作包括使用 AMD Quark 将 GLM5.2 量化到 MXFP4,并采用 sglang 推理框架,同时对 ROCm 的投机解码进…