实体
Visco
Visco
PulseAugur coverage of Visco — every cluster mentioning Visco across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
VisCo框架使用LLM进行高效视觉令牌压缩
研究人员开发了VisCo,一个用于压缩视觉语言模型(VLM)中视觉令牌的新型框架。与需要大量重新训练或外部模块的先前方法不同,VisCo利用VLM的现有能力作为内在压缩器。这种训练高效的方法使用带有内存令牌的参数共享自编码器来压缩视觉信息,在各种压缩比下均表现出优越的性能,甚至在与原始令牌结合时也能改进基础模型。
-
新方法大幅削减OmniLLM Token成本,提高效率和准确性 · 跟踪9个来源
研究人员开发了多种新颖的方法来压缩全模态大语言模型(OmniLLMs)中的Token序列,以降低内存和推理成本。这些方法,包括OmniDelta、OmniScope、Progressive Cramming、PCA和ReMo,专注于在音频、视频和文本等模态之间智能地分配和修剪Token。通过解耦模态相关性、利用查询相似性以及识别冗余或分布外Token,这些技术旨在在显著降低计算开销的同时,维持甚至提高准确性。实验表明,GPU内存大幅减…