Reddit r/LocalLLaMA 版块的一位用户正在寻求推荐,希望找到能在配备 8 GB 显存的系统上有效运行的最佳本地大型语言模型 (LLM),特别适用于编码和代理编码任务。该用户分享了他们当前的设置,包括一块拥有 8 GB 显存的 RTX 3070 笔记本 GPU,以及他们偏好的模型 Unsloth 的 Qwen3.6-35B-A3B-UD-IQ4_NL,该模型在代理编码任务中能达到大约 25 tokens/s 的速度。他们优先考虑速度、编码能力、工具使用、可靠性和最终输出质量的平衡,而不是原始基准分数,并正在向社区征求实际经验和模型建议。 AI
影响 为在消费级硬件上优化 LLM 编码任务性能提供了见解。
排序理由 用户生成讨论和关于在有限硬件上运行 LLM 的推荐请求。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →