PulseAugur
中
实时 11:32:16
实体 2D VLMs

2D VLMs

PulseAugur coverage of 2D VLMs — every cluster mentioning 2D VLMs across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 2 条
  1. RESEARCH · CL_242964 ·

    新的CoVeR方法为视觉语言模型(VLM)中的三维推理剪枝视觉令牌

    研究人员开发了CoVeR,一种在处理由多视角图像表示的三维场景时,用于剪枝视觉语言模型(VLM)中视觉令牌的新颖方法。该技术解决了使用多视角产生的冗余令牌问题,这可能导致计算成本高昂。CoVeR是一种确定性的、无需训练的选择器,它使用令牌坐标来确保场景的完整空间覆盖,同时遵守确切的令牌预算,克服了先前基于重要性或体素化方法的局限性。实验表明,CoVeR在三维推理基准测试中显著优于现有的最先进方法,在大幅减少令牌数量的同时实现了高性能。

  2. RESEARCH · CL_180764 ·

    3DZip 框架将 3D VLM 令牌减少 97%,提升推理速度

    研究人员开发了 3DZip,一个新颖的三阶段框架,旨在压缩 3D 视觉语言模型 (3D VLM) 的令牌。该方法解决了 3D VLM 中每场景通常产生的数千个令牌所带来的显著计算和内存开销。通过采用粗粒度体素化、使用行列式点过程的特征空间多样性选择以及空间约束合并,3DZip 在保持几何一致性的同时有效地减少了令牌数量。实验表明,3DZip 仅用 128 个令牌即可保持 94.7% 的原始性能,在 3D 问答基准测试中推理速度提高了 …