NVIDIA 推出了 LocateAnything,一个专为视觉定位任务设计的新模型。该模型利用并行盒解码将视觉定位转化为基础代理能力。此举旨在增强 AI 代理与视觉信息交互和理解的方式。 AI
影响 通过提供更强大的视觉定位方法来增强 AI 代理的能力。
排序理由 该集群描述了一家主要科技公司的新模型发布,属于研究或产品发布类别。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →