微信推出了WeMM-Embedding,这是一个新的通用多模态嵌入模型系列,旨在将文本、图像、视频和交错的多模态输入表示在共享空间中。该模型有2B、4B和9B版本,经过两阶段训练,并在公开基准测试中展示了最先进(SOTA)的性能,其中2B版本在MMEB-v2上优于8B基线。WeMM-Embedding已部署到微信的多个应用中,包括视频号、公众号和朋友圈,在推荐和搜索功能方面取得了显著的提升。 AI
影响 在多模态基准测试上设定了新的SOTA,并增强了微信应用内的检索/推荐能力。
排序理由 该集群描述了一份技术报告,详细介绍了一个新的多模态嵌入模型系列,包含基准测试结果和发布信息。
在 arXiv cs.IR (Information Retrieval) 阅读 →
- arXiv
- Hugging Face
- MMEB-v2
- Moments
- Official Accounts
- tencent/WeMM-Embedding-2B
- WeChat Channels
- WeChat Vision team
- WeMM-Embedding
AI 生成摘要 · Google Gemini · 来自 3 个来源。 我们如何撰写摘要 →