研究人员开发了一种新颖的StepPrune方法,用于在多模态大语言模型(MLLMs)中自适应地选择视觉标记以加速推理。与之前独立处理标记的Top-K方法不同,StepPrune根据先前选择的标记和文本上下文来顺序选择标记,动态确定要保留的标记数量。该方法在LLaVA-1.5上已显示出显著的性能保留,实现了94.6%的完整前缀归一化性能,同时删除了88.9%的视觉标记。该方法还实现了1.50倍的预填充速度提升,将延迟从59.95毫秒降低到40.05毫秒。 AI
影响 这种自适应标记选择方法可以显著加快多模态大语言模型的推理速度,从而实现更高效的实时应用。
排序理由 该集群包含一篇详细介绍多模态大语言模型新方法的论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →