PulseAugur
实时 18:34:35

CohereLabs 发布 2.4B 开放权重视觉语言模型

CohereLabs 发布了 North-Micro-Vision-Instruct,一个拥有 24 亿参数的开放权重视觉语言模型。该模型支持原生分辨率图像处理,并采用 Apache 2.0 许可,适合原型设计和专业多模态应用。它提供广泛的图像理解能力,包括 VQA、图像描述和 OCR,并支持多种语言和图像。 AI

影响 为研究人员和开发人员提供了一个紧凑、可定制的视觉语言模型。

排序理由 研究实验室发布开放权重模型。[lever_c_demoted from research: ic=1 ai=1.0]

在 r/LocalLLaMA 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

CohereLabs 发布 2.4B 开放权重视觉语言模型

报道来源 [1]

  1. r/LocalLLaMA TIER_1 English(EN) · /u/pmttyji ·

    CohereLabs/North-Micro-Vision-Instruct · Hugging Face

    <table> <tr><td> <a href="https://www.reddit.com/r/LocalLLaMA/comments/1vmjmna/coherelabsnorthmicrovisioninstruct_hugging_face/"> <img alt="CohereLabs/North-Micro-Vision-Instruct · Hugging Face" src="https://external-preview.redd.it/R9TifauXCeIBOuonFF3__kl1e0_4fNHlfv78XrlQe0M.png…