一位 Reddit r/LocalLLaMA 版块的用户正在寻求关于 Qwen 27B 模型最快、最有效的“删除安全限制”(safety-removed)版本的推荐,特别是比较 3.6 和 3.8 版本。用户打算在“关闭思考”(thinking off)的指令遵循基准测试中测试这些模型,以确定哪个版本在需要较少复杂推理的任务上表现更好。他们正在寻找用户最喜欢的、适合其拥有 24GB 显存的系统的快速量化版本,并指出一些已测试过的模型速度太慢。 AI
影响 提供了对微调后的开源模型用户偏好和性能期望的见解。
排序理由 用户讨论和对特定模型变体的推荐请求。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →