Google DeepMind 发布了 DiffusionGemma,一个开源的AI模型,它以并行块而非顺序的方式生成文本,这与传统的逐token生成不同。这种块扩散方法允许模型同时优化整个文本片段,从而显著提高推理速度,据报道,在单个NVIDIA H100上比同类Gemma模型快四倍。DiffusionGemma模型基于Gemma 4 26B架构构建,拥有256K的上下文窗口,支持140多种语言,并能处理文本、图像和视频输入,所有这些都在宽松的Apache 2.0许可下。 AI
影响 引入了一种新的并行生成范式,可以显著加快LLM推理速度,将重点从硬件转移到算法创新。
排序理由 前沿实验室模型发布,采用新颖的生成技术。[lever_c_降级自 frontier_release: ic=1 ai=1.0]
- Apache Software License 2.0
- DiffusionGemma
- Gemma
- Gemma 4: 26b
- Google DeepMind
- Groq
- NVIDIA
- NVIDIA H100
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →