研究人员开发了两种新颖的框架,用于将视觉语言模型(VLMs)适应专业领域。第一个是归纳视觉逻辑(IVL),它使用一种无需训练的方法,从VLMs的描述能力中构建分类知识,特别适用于分布外任务。第二个是ScaleEarth with CS-HLoRA,它通过将低秩适应条件化于图像的地面采样距离(GSD)来适应遥感VLMs,在对尺度敏感的任务上取得了改进的性能。 AI
影响 这些方法为将强大的VLMs适应利基领域提供了新途径,有可能提高它们在遥感和分布外分析等专业领域的效用。
排序理由 两篇研究论文介绍了视觉语言模型的新颖适应框架。
- arXiv
- CatalyzeX
- CS-HLoRA
- DagsHub
- Gotit.pub
- Hugging Face
- Inductive Visual Logic
- LLaVA
- Qwen VL
- ScaleEarth
- ScienceCast
- Yanlong Chen
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →