r/LocalLLaMA subreddit 上的一位用户正在寻求关于使用非英伟达 GPU 进行本地大型语言模型推理的建议。他们目前拥有 RTX Pro 6000 和 RTX 5090 显卡,并考虑通过增加 GPU 来扩展他们的服务器,特别关注英特尔和 AMD 选项,因为它们每美元的显存更高。用户正在询问在这些替代硬件平台上与成熟的英伟达/CUDA 生态系统相比,推理性能的经验和比较。 AI
影响 探讨在本地运行 LLM 的硬件选择,影响个人运营商的成本和性能。
排序理由 用户讨论用于 LLM 推理的硬件。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →