PulseAugur
实时 18:17:53
实体 Multimodal Intelligent Enchancement

Multimodal Intelligent Enchancement

PulseAugur coverage of Multimodal Intelligent Enchancement — every cluster mentioning Multimodal Intelligent Enchancement across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. RESEARCH · CL_154671 ·

    HOMIE框架通过集成MLLM来增强视频个性化

    研究人员开发了HOMIE,一个新的人类-对象中心视频个性化(HOCVP)框架。该方法旨在提高视频中主体的保真度和交互准确性,即使是像Logo这样的抽象概念。HOMIE集成了多模态大语言模型(MLLMs),以更好地理解主体和对象之间的关系,并包含一个模态参考嵌入,以区分MLLM特征和其他视觉标记。该框架旨在有效处理主体间和主体内个性化场景。