ROCmFPX
PulseAugur coverage of ROCmFPX — every cluster mentioning ROCmFPX across labs, papers, and developer communities, ranked by signal.
2 天有情绪数据
-
Mastodon 上的 AI 进展:ROCmFPX 代码和 Qwen3.8-27B 发布
Mastodon 上正在流传两条独立的 AI 相关帖子。一位开发者正在为 ROCmFPX 开发特定代码,该代码将仅在 Strix Halo 上运行。另一则帖子重点介绍了一个未审查版本的 Qwen3.8-27B,由 elderplinius 作为 AI Red Team 的一部分发布,可供本地使用。
-
Qwen 3.8 27B NVFP4 为 Synth Invaders 提供 AMD 硬件支持
一位用户已成功在配备 ROCmFPX 的 AMD R9700 AI Pro 上运行了使用 Qwen 3.8 27B NVFP4 创建的 Synth Invaders 应用程序。ROCmFPX 被指出能提供出色的 NVFP4 GGUF 推理能力。
-
DeepSeek V4 Flash 模型针对 AMD Ryzen AI MAX+ 395 进行了优化
一种名为 ROCmFPX 的新方法已被开发出来,可将拥有 2840 亿参数的 DeepSeek V4 Flash 模型适配到 AMD Ryzen AI MAX+ 395 处理器上的 128 GB 统一内存中。该技术利用了一系列具有不同每权重比特精度的块格式,实现了高效的存储和处理。优化后的模型达到了高达每秒 32 个 token 的解码速率,显著优于先前类似硬件配置的基准测试。
-
AMD MI355X 性能因社区黑客马拉松而提升,在 Kimi 模型上可与 B200 匹敌 · 跟踪 6 个来源
AMD 与 GPU_MODE 合作,启动了一个耗资 110 万美元的内核黑客马拉松,显著提升了其 MI355X 图形卡的性能。Readonflow Team 的优化专注于 MoE 内核和其他核心组件,带来了高达 4 倍的性能提升,并已合并到 AMD 的 AITER 内核库和 ATOM 推理引擎中。该计划旨在使 AMD 的 vLLM 性能接近 CUDA vLLM 的水平,并增强社区对 ROCm 堆栈的体验。