Google DeepMind发布了EmbeddingGemma 2,一个拥有7.4亿参数的开源多模态嵌入模型。该模型将文本、图像、视频和音频统一到一个单一的768维向量空间中,提供多语言支持并改进了代码任务的性能。它专为设备端应用设计,只需最少的RAM,可用于搜索、RAG和分类等任务,并具备Matryoshka Representation Learning等功能以降低存储成本。 AI
影响 支持高效的设备端多模态应用,如RAG和搜索,并可能通过其存储优化功能降低成本。
排序理由 来自前沿实验室(Google DeepMind)的开源多模态模型发布。[lever_c_demoted from frontier_release: ic=2 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →