UkisAI 开发了一个 Qwen 3.8 27B 模型的后训练版本,名为 Swift-Qwen3.8-27B,它显著减少了 58.3% 的“思考”token,并将速度提高了 1.95 倍,同时将精度损失控制在 1% 以内。此优化针对并惩罚与过度思考相关的 token,而不影响推理长度或质量。该模型可在 Hugging Face 上获取,并提供各种社区量化版本,UkisAI 还提供由 Nvidia GPU 驱动的研究用途 API。 AI
影响 这种模型优化可能导致在资源受限的环境中更有效地部署大型语言模型。
排序理由 该项目描述了一个具有性能改进和开源权重的后训练模型发布,符合研究类别。[lever_c_从研究降级:ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →