PulseAugur
实时 12:35:04
实体 AMD MI355X

AMD MI355X

PulseAugur coverage of AMD MI355X — every cluster mentioning AMD MI355X across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
2
90 天内 4
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天

2 天有情绪数据

最近 · 第 1/1 页 · 共 4 条
  1. TOOL · CL_176448 ·

    AMD MI355X 内核优化显示性能提升 4 倍,但仍落后于竞争对手

    AMD 和 GPU_MODE 社区最近组织的一次内核黑客马拉松,显著提升了 AMD MI355X 显卡的性能。据报道,Readonflow Team 的优化内核将 MI355X 的端到端上游性能提升了四倍多。尽管这一进展显示出希望,但 AMD 在 Kimi 模型上的 vLLM 性能仍落后于竞争对手,不过预计未来会有改进。

  2. TOOL · CL_158504 ·

    MiniMax AI 通过 AMD MI355X 优化,性能接近 NVIDIA B200

    MiniMax AI 利用 AMD 的 MI355X 硬件,在其 Minimax M3 模型上实现了接近 NVIDIA B200 的性能。这一进展得益于 AMD 的 ATOM 和 ATOMesh 技术的全栈协同优化,具体细节已在近期技术博客中披露。此次优化特别有利于 MiniMax 的 428B MSA 稀疏 MoE 多模态基础模型,并采用了 EAGLE3 投机解码等技术以提高生成效率。

  3. RESEARCH · CL_124739 ·

    新AI模型Leanstral 1.5发布;AMD MI355X大幅降低AI计算成本

    名为Leanstral 1.5的新AI模型已发布,声称通过其先进的功能带来丰富和革命性的行业变革。另外,使用AMD MI355X的AI计算进步据报道比Blackwell的成本低2倍,可能使AI更容易获得并促进创新。

  4. SIGNIFICANT · CL_124570 ·

    GLM5.2 部署在 AMD MI355X 上以实现更便宜的推理 · 已追踪 5 个来源

    Wafer.ai 已成功将 GLM5.2 部署在 AMD MI355X 硬件上,实现了 2626 tokens/秒/节点 的吞吐量和 213 tokens/秒 的单流推理速度。此次部署具有成本优势,MI355X GPU 的成本大约比 NVIDIA 的 Blackwell B300 低 2.75 倍。优化工作包括使用 AMD Quark 将 GLM5.2 量化到 MXFP4,并采用 sglang 推理框架,同时对 ROCm 的投机解码进…