研究人员开发了ConFusion,一个用于细粒度可控红外与可见光图像融合的新框架。该方法使用高斯条件空间感知调制学习连续融合空间,从而能够灵活地整合热信息和结构信息。ConFusion采用双分支架构来解耦表示,并利用多模态大语言模型将用户意图解释为调制变量,以实现精确的图像融合。实验表明,ConFusion在融合质量和下游任务性能方面均优于现有方法。 AI
影响 通过利用大语言模型进行控制,为下游应用实现更精确、更具适应性的图像融合。
排序理由 该条目描述了一篇关于新型图像融合框架的最新研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
在 Hugging Face Daily Papers 阅读 →
- ConFusion
- Gaussian-conditioned spatial-aware modulation
- Mask-Guided Specific Feature Modulator
- multimodal large language model
- Text-Driven Invariant Feature Enhancer
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →