研究人员推出了 DiffusionGemma,这是一款专为高速文本生成设计的实验性开放权重语言模型。与顺序处理 token 的传统自回归模型不同,DiffusionGemma 使用离散扩散并行优化 256 个 token 的块。该模型源自 Gemma 4 混合专家模型,在单个 NVIDIA H100 GPU 上可实现约每秒 1,500 个输出 token 的速度,显著优于传统方法。 AI
影响 为生成速度和模型能力建立了新的帕累托前沿,有可能加速需要快速文本输出的 AI 应用。
排序理由 在 arXiv 上发布了详细介绍新型实验性语言模型的技朧报告。
在 Hugging Face Daily Papers 阅读 →
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →