腾讯发布了WeMM-Embedding-2B,一个基于Qwen 3.5架构构建的多模态嵌入模型。该模型能够处理文本、图像、视频和视觉文档以生成2048维嵌入,但不支持音频输入。它设计用于与Hugging Face的Transformers和sentence-transformers等流行库集成,并提供了使用示例和安装说明。 AI
影响 通过提供一个通用的文本、图像和视频嵌入模型,支持新的多模态应用。
排序理由 发布新的多模态嵌入模型,并附带使用示例。[lever_c_demoted from research: ic=1 ai=1.0]
在 Hugging Face Trending Models 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →