IFM 发布了 K2-Horizon-7B,这是一款扩散增强的大型语言模型,在不损失质量的情况下,速度可达每秒 5200 个 token。该模型采用了因果 LLM 架构,并在其自回归权重中集成了即插即用的扩散适配器。 AI
影响 该模型在不损失质量的情况下实现的高 token/秒速率,可能会显著提高各种 LLM 应用的推理速度。
排序理由 该条目描述了一个具有技术细节和性能声明的新模型发布,符合研究类别。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →