AMD 与 GPU_MODE 合作,启动了一个耗资 110 万美元的内核黑客马拉松,显著提升了其 MI355X 图形卡的性能。Readonflow Team 的优化专注于 MoE 内核和其他核心组件,带来了高达 4 倍的性能提升,并已合并到 AMD 的 AITER 内核库和 ATOM 推理引擎中。该计划旨在使 AMD 的 vLLM 性能接近 CUDA vLLM 的水平,并增强社区对 ROCm 堆栈的体验。 AI
影响 通过提高推理性能和促进其 ROCm 堆栈上的社区开发,增强了 AMD 在人工智能硬件领域的竞争力。
排序理由 社区驱动的性能优化和 AMD 硬件内核的合并。
- AMD
- Anthropic
- Instella-MoE
- MI300X
- MI325X
- Mythos
- NVIDIA
- ROCm
- ROCmFPX
- White House
- AIatAMD
- AnushElangovan
- ATOM
- marksaroufim
- MI355X
- Nvidia B200
- Readonflow Team
- vLLM
AI 生成摘要 · Google Gemini · 来自 6 个来源。 我们如何撰写摘要 →