一位用户在拥有16GB显存的系统上对IFM/K2-Horizon-7B模型进行了基准测试,发现其性能远不如Qwen3.8-27B和Ornith-1.5-9B。尽管模型完全装入16GB显存,K2-Horizon-7B模型仍表现不佳,多项任务超时,一项任务导致代码损坏。基准测试表明,Qwen3.8-27B是最佳性能模型,即使量化不那么理想,而Ornith-1.5-9B则提供了速度和可用性的良好平衡。 AI
影响 突出了小型模型在消费级硬件上的性能限制,并强化了更大、更成熟模型的优势。
排序理由 用户对特定模型在有限硬件上性能的基准测试。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →