Radeon VII
PulseAugur coverage of Radeon VII — every cluster mentioning Radeon VII across labs, papers, and developer communities, ranked by signal.
2 天有情绪数据
-
gfx906-llama-cpp 更新使 AMD GCN GPU 性能得到提升
gfx906-llama-cpp 项目发布了一个更新,显著提高了 AMD GCN GPU(包括 MI50、MI60 和 Radeon VII)的性能。此次更新整合了现有 llama.cpp pull requests 的优化,在预填充性能方面提升高达 23%,在深度填充任务方面提升 14%。该项目还扩展了上下文能力,现在支持高达 250k token 的内存(40GB),同时保持位相同输出。
-
为 AMD GFX906 GPU 发布的 llama.cpp 分支优化
llama.cpp 项目的一个分支已被开发出来,以优化在 AMD GFX906 GPU 上的性能。这个优化版本旨在提高在特定 AMD 硬件(包括 MI50、MI60 和 Radeon VII 显卡)上运行大型语言模型的效率。开发者正在寻求对这一专门实现的反馈。
-
Nvidia的GTX 1080 Ti:一款十年老GPU的性能与功耗限制揭晓
发布十年后,Nvidia的GTX 1080 Ti显卡在1080p游戏中仍能提供可观的性能,尤其是在老游戏和受益于其11GB显存的游戏中。然而,与当前一代GPU相比,DLSS和光线追踪等现代技术以及显著提高的功耗效率,都凸显了它的老旧。虽然它仍能超越一些低端现代显卡,但通常会被过去五年内的中端产品超越,并且功耗要高得多。
-
为本地 LLM 推理寻求预算 GPU 建议
一位用户在 r/LocalLLaMA 子版块上寻求关于在预算有限的情况下购买硬件以运行大型语言模型的建议。他们正在考虑购买一张拥有 32GB 显存的 Radeon VII,或者两张提供总计 48GB 显存的 P100 GPU,两者价格相似。用户正在权衡更多显存和更快推理速度之间的取舍,特别是询问更高的显存对于 Q8 量化的专家混合(MoE)模型是否有用,并寻求其他合适的 MoE 模型推荐。
-
GPU用户发现功耗限制可节省能源,性能损失极小
r/LocalLLaMA subreddit上的用户正在分享如何降低GPU功耗的技巧。大家的共识是,通过限制GPU的功耗上限,用户可以实现显著的节能,同时性能只略有下降。一位用户报告称,在他的双Radeon VII设置中,每张卡的功耗从250W降至100W,性能下降不到10%。
-
LocalLLaMA 用户报告 MTP 优化导致性能下降
一位 r/LocalLLaMA 子版块的用户在使用 Qwen 3.6 27B 模型并启用“MTP”(可能是多线程处理或类似优化)时,遇到了性能和 GPU 利用率显著下降的情况。用户指出,该问题与内存无关,而是处理速度的下降,并正在寻求对此行为的解释。他们推测潜在原因可能包括 PCIe 延长线引起的总线争用或 Vulkan API 的问题。