PulseAugur
中
实时 07:32:30
实体 VisionFoundry

VisionFoundry

PulseAugur coverage of VisionFoundry — every cluster mentioning VisionFoundry across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. RESEARCH · CL_273387 ·

    合成数据管道 VisionFoundry 提升 VLM 感知技能 · 已追踪 2 个来源

    研究人员开发了 VisionFoundry,这是一个自动化管道,利用大型语言模型(LLM)和文本到图像模型来生成用于训练视觉语言模型(VLM)的合成视觉感知数据。这个名为 VisionFoundry-10k 的合成数据集在空间理解和视角识别等感知基准测试中,持续提高了 VLM 的性能,甚至优于在自然图像上训练的模型。该方法具有可扩展性和有效性,证明了合成监督可以显著增强 VLM 的能力。