一位 Reddit r/LocalLLaMA 社区用户正在寻找参数量低于 400 亿的大型语言模型推荐,作为 Qwen 和 DeepSeek 的替代品。用户特别需要擅长编程任务和长文档问答的模型,尤其是在处理长达 120,000 个 token 的上下文时。他们正在询问 Gemma 31B、Muse Glimmer 30B 和 Nemotron 等模型,以及这些替代模型的任何微调版本是否能在编程能力上超越 Qwen 3.8 27B。 AI
影响 识别出社区对编程和长上下文任务特定模型能力的兴趣。
排序理由 Reddit 用户关于模型推荐的查询。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →