在 r/LocalLLaMA 子版块的用户正在讨论哪些大型语言模型可以有效地利用12GB显存。对话中提到 Qwen 3.6 35B 3A 曾是一个受欢迎的选择,但用户正在寻找更新的或专门优化的模型,以便在总显存不超过16GB的情况下,利用超过8GB的额外显存。提到的主要用例是个人秘书和经理任务,而非繁重的编码工作。 AI
排序理由 这是用户关于运行LLM特定硬件限制的讨论,并非发布或重要的行业事件。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →
在 r/LocalLLaMA 子版块的用户正在讨论哪些大型语言模型可以有效地利用12GB显存。对话中提到 Qwen 3.6 35B 3A 曾是一个受欢迎的选择,但用户正在寻找更新的或专门优化的模型,以便在总显存不超过16GB的情况下,利用超过8GB的额外显存。提到的主要用例是个人秘书和经理任务,而非繁重的编码工作。 AI
排序理由 这是用户关于运行LLM特定硬件限制的讨论,并非发布或重要的行业事件。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →
完整方法见我们的编辑标准。
<!-- SC_OFF --><div class="md"><p>Hi!</p> <p>I've been following this community for quite a while and have difficulty figuring out what to put on my 3080 12gb - I know Qwen 3.6 35B 3A was the go-to choice when it first came out, but I'm curious if there are any other models / spe…