PulseAugur
实时 14:57:23
实体 MI325X

MI325X

PulseAugur coverage of MI325X — every cluster mentioning MI325X across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 3 条
  1. TOOL · CL_187907 ·

    DeepSeek-V4-Flash-0731 模型在 AMD MI325X 上使用 vLLM 时表现异常

    一位 Reddit 用户在使用 vLLM 在 AMD MI325X GPU 上运行 DeepSeek-V4-Flash-0731 模型时遇到了严重问题。尽管遵循了推荐的设置,但模型表现出异常行为,包括不正确的工具使用、无意义的响应以及对话上下文的丢失。用户怀疑问题出在聊天模板、编码、推理或工具集成上,或者可能是 vLLM 的 ROCm 实现问题。

  2. RESEARCH · CL_166886 ·

    AMD MI355X 性能因社区黑客马拉松而提升,在 Kimi 模型上可与 B200 匹敌 · 跟踪 6 个来源

    AMD 与 GPU_MODE 合作,启动了一个耗资 110 万美元的内核黑客马拉松,显著提升了其 MI355X 图形卡的性能。Readonflow Team 的优化专注于 MoE 内核和其他核心组件,带来了高达 4 倍的性能提升,并已合并到 AMD 的 AITER 内核库和 ATOM 推理引擎中。该计划旨在使 AMD 的 vLLM 性能接近 CUDA vLLM 的水平,并增强社区对 ROCm 堆栈的体验。

  3. TOOL · CL_153047 ·

    Unsloth为更快的本地LLM训练增加了AMD GPU支持

    Unsloth发布了一项更新,显著增强了对AMD GPU的支持,从而可以在各种AMD硬件上进行本地LLM训练和推理。新版本承诺在不影响准确性的情况下,性能提升高达2倍,显存使用量减少70%。更新还包括对ROCm的优化、与MI300X和MI325X等特定AMD GPU的兼容性改进,以及运行更大模型和更可靠下载的增强功能。