Google DeepMind 开发了 DiffusionGemma,这是一个通过改装 Gemma 4 创建的文本扩散模型。这种方法所需的原始训练预算不到 10%,并且可以并行生成 256 个 token,速度约为每秒 1,500 个 token。虽然比传统的自回归模型快,但 DiffusionGemma 在推理任务上的表现仍落后于其前身。 AI
影响 这种方法可以显著降低开发新文本生成模型所需的计算成本和时间。
排序理由 该条目描述了一种通过改装现有模型而不是从头开始训练来创建文本扩散模型的新研究方法。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →