研究人员开发了 AdaThinkV,一个旨在提高视频多模态大语言模型在推理过程中 token 效率的新框架。这种自适应方法可以根据每个问题的复杂性来调整其推理力度,避免在简单查询上不必要地使用 token。AdaThinkV 通过平衡准确性提升与响应长度来实现这一点,并结合了方差恢复策略优化(VRPO)来从挑战性提示中提取有用信号。在评估中,AdaThinkV 与现有的自适应基线相比,表现出了更优越的性能,以显著更少的输出 token 实现了更高的准确性。 AI
影响 这项研究可能有助于在实际应用中更高效、更经济地部署视频推理模型。
排序理由 详细介绍 LLM 效率新方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →