Alibaba的Qwen团队发布了Qwen3.8-Flash,这是一个拥有125B参数的模型,可以在75GB内存上本地运行。据报道,这个新模型在某些指标上优于Claude Opus-4.6。通过Unsloth GGUFs实现的优化,即使在CPU内存或统一内存设置下也能达到接近VRAM的速度。 AI
影响 使得在消费级硬件上部署高性能LLM成为可能,从而可能降低高级AI应用的入门门槛。
排序理由 前沿实验室模型发布,并附有性能声明。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →