Google 发布了 Gemma 2,包含新的 9B 和 27B 参数模型,这些模型优先考虑架构效率而非单纯的规模。这些模型采用了经过重新设计的 Transformer 架构,结合了混合注意力机制和分组查询注意力(Grouped-Query Attention),从而降低了计算和内存成本。这种效率使得 27B 模型可以在单个 NVIDIA H100 或 Google TPU 上运行,使其能够与更大的模型竞争,并降低了开发者的部署成本。 AI
影响 通过降低推理成本和硬件要求,赋能更强大、更高效的开源人工智能应用。
排序理由 大型人工智能实验室(Google)发布新模型,包含具体的架构细节和性能声明。 [lever_c_demoted from frontier_release: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →