PulseAugur
实时 19:03:10

OMLAB发布VLX-Seek-1.5-10B用于具身视觉基础

OMLAB发布了VLX-Seek-1.5-10B,这是一个开源的100亿参数模型,专为具身场景中的细粒度视觉感知和基础设计。该模型针对无人机、机器人和监控系统等实际应用进行了优化,专注于识别、定位和避开缺失的对象。VLX-Seek-1.5-10B将定位重新表述为区域检索和参考,增强了其与语言模型在比较和推理等方面的优势。 AI

影响 该模型为具身AI系统提供了专门的能力,有可能改善现实世界机器人和监控应用中的感知和定位。

排序理由 发布了一个具有特定技术细节和预期用途的开源模型。[lever_c_demoted from research: ic=1 ai=1.0]

在 r/LocalLLaMA 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

OMLAB发布VLX-Seek-1.5-10B用于具身视觉基础

报道来源 [1]

  1. r/LocalLLaMA TIER_1 Bahasa(ID) · /u/pmttyji ·

    omlab/VLX-Seek-1.5-10B · Hugging Face

    <table> <tr><td> <a href="https://www.reddit.com/r/LocalLLaMA/comments/1vkaypz/omlabvlxseek1510b_hugging_face/"> <img alt="omlab/VLX-Seek-1.5-10B · Hugging Face" src="https://external-preview.redd.it/RRRKj_79WNmuVZ7Q28kzp8kCRw8Jo4xGcQetJiu-1Ik.png?width=640&amp;crop=smart&amp;aut…