PulseAugur
实时 00:07:03
English(EN) What's the best local model you've found for 8 GB of VRAM?

Reddit 上正在寻找适用于编码和代理任务的最佳 8GB 显存本地 LLM

Reddit r/LocalLLaMA 版块的一位用户正在寻求推荐,希望找到能在配备 8 GB 显存的系统上有效运行的最佳本地大型语言模型 (LLM),特别适用于编码和代理编码任务。该用户分享了他们当前的设置,包括一块拥有 8 GB 显存的 RTX 3070 笔记本 GPU,以及他们偏好的模型 Unsloth 的 Qwen3.6-35B-A3B-UD-IQ4_NL,该模型在代理编码任务中能达到大约 25 tokens/s 的速度。他们优先考虑速度、编码能力、工具使用、可靠性和最终输出质量的平衡,而不是原始基准分数,并正在向社区征求实际经验和模型建议。 AI

影响 为在消费级硬件上优化 LLM 编码任务性能提供了见解。

排序理由 用户生成讨论和关于在有限硬件上运行 LLM 的推荐请求。

在 r/LocalLLaMA 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

Reddit 上正在寻找适用于编码和代理任务的最佳 8GB 显存本地 LLM

报道来源 [1]

  1. r/LocalLLaMA TIER_1 English(EN) · /u/Elemental_Particle ·

    您找到的8GB显存的最佳本地模型是什么?

    <!-- SC_OFF --><div class="md"><p>I'm curious what other people are using for <strong>local LLM coding / agentic coding with only 8 GB of VRAM</strong>.</p> <p>My current setup is:</p> <ul> <li>Intel <strong>Core i7-11800H</strong></li> <li><strong>RTX 3070 Laptop</strong>, 8 GB …