AMD MI355X
PulseAugur coverage of AMD MI355X — every cluster mentioning AMD MI355X across labs, papers, and developer communities, ranked by signal.
- 2026-09-04 research_milestone AMD MI355x hardware shows improved token efficiency over B300 in AgentX. 来源
1 天有情绪数据
-
AMD MI355X 通过 SGLang 和 UMBP 集成缩小了与 GB300 的性能差距 · 跟踪 3 个来源
SemiAnalysis 报道称,AMD 的 MI355X 在代理推理性能和总拥有成本方面正在迅速提高,接近 GB300 的水平。这一进步归功于 AMD 的 SGLang 团队及其 MoRI 库,Universitas Mandiri Bina Prestasi (UMBP) 也做出了重要贡献。UMBP 作为 KV 卸载后端集成到 SGLang 中,特别是通过 KVCache Store Linker,优化了 High Bandwid…
-
AMD MI355x硬件在AgentX的token效率方面优于B300 · 跟踪2个来源
AMD MI355x硬件的一项新提交显示,在总拥有成本(TCO)的输出总token数方面,其性能优于B300,尤其是在AgentX框架内的低交互性范围内。SemiAnalysis强调了这一成就,并特别表彰了vLLM、AMD和LMCache的工程团队所做的贡献。高吞吐量配置中使用的分离式设置被认为是实现这一性能提升的关键因素。
-
2026年顶级GPU Neoclouds:CoreWeave、Nebius、Lambda、Crusoe、Groq排名
2026年GPU Neocloud提供商排名显示,CoreWeave是唯一获得铂金评级的选项,其高端NVIDIA GPU定价较高。Nebius在公布最新B300芯片的按需定价方面处于领先地位,而Lambda提供最实惠的B200费率。Crusoe的独特之处在于其定价列表中包含AMD的MI300X/MI355X,而Groq正逐步在其LPU推理云中加入NVIDIA GPU容量。
-
AMD MI355X 内核优化显示性能提升 4 倍,但仍落后于竞争对手
AMD 和 GPU_MODE 社区最近组织的一次内核黑客马拉松,显著提升了 AMD MI355X 显卡的性能。据报道,Readonflow Team 的优化内核将 MI355X 的端到端上游性能提升了四倍多。尽管这一进展显示出希望,但 AMD 在 Kimi 模型上的 vLLM 性能仍落后于竞争对手,不过预计未来会有改进。
-
MiniMax AI 通过 AMD MI355X 优化,性能接近 NVIDIA B200
MiniMax AI 利用 AMD 的 MI355X 硬件,在其 Minimax M3 模型上实现了接近 NVIDIA B200 的性能。这一进展得益于 AMD 的 ATOM 和 ATOMesh 技术的全栈协同优化,具体细节已在近期技术博客中披露。此次优化特别有利于 MiniMax 的 428B MSA 稀疏 MoE 多模态基础模型,并采用了 EAGLE3 投机解码等技术以提高生成效率。
-
新AI模型Leanstral 1.5发布;AMD MI355X大幅降低AI计算成本
名为Leanstral 1.5的新AI模型已发布,声称通过其先进的功能带来丰富和革命性的行业变革。另外,使用AMD MI355X的AI计算进步据报道比Blackwell的成本低2倍,可能使AI更容易获得并促进创新。
-
GLM5.2 部署在 AMD MI355X 上以实现更便宜的推理 · 已追踪 5 个来源
Wafer.ai 已成功将 GLM5.2 部署在 AMD MI355X 硬件上,实现了 2626 tokens/秒/节点 的吞吐量和 213 tokens/秒 的单流推理速度。此次部署具有成本优势,MI355X GPU 的成本大约比 NVIDIA 的 Blackwell B300 低 2.75 倍。优化工作包括使用 AMD Quark 将 GLM5.2 量化到 MXFP4,并采用 sglang 推理框架,同时对 ROCm 的投机解码进…