PulseAugur
实时 09:51:28
English(EN) InstructVVT: Instruction-Driven Video Virtual Try-On without Auxiliary Spatial Priors

InstructVVT框架实现了指令驱动的视频虚拟试穿

研究人员开发了InstructVVT,一个用于视频虚拟试穿的新框架,它使用扩散Transformer和多模态大语言模型,在不依赖辅助空间先验的情况下实现精确的服装替换。这种方法可以直接从源视频、参考服装和指令输入中进行细粒度控制。与ViViD-S和TripVVT-Bench等基准上的现有方法相比,该系统在服装保真度、结构保持和时间一致性方面表现出卓越的性能。 AI

影响 这项研究可能为电子商务和时尚领域带来更现实、更可控的虚拟试穿体验。

排序理由 详细介绍视频虚拟试穿新方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.CV 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

InstructVVT框架实现了指令驱动的视频虚拟试穿

报道来源 [1]

  1. arXiv cs.CV TIER_1 English(EN) · Dingbao Shao, Song Wu, Xinyu Chen, Qian Wang, Jiahang Li, Kuai Jiang, Jiang Lin, Yuhang Liu, Ziyu Chen, Duo Li, Jiaxin Hu, Shengrong Gu, Ziheng Tang, Rongrong Liu, Yanlun Peng, Liang Li, Junlan Feng, Lujia Jin, Ting Zhang, Jian Yang, Zili Yi ·

    InstructVVT:无需辅助空间先验的指令驱动视频虚拟试穿

    arXiv:2608.14070v1 Announce Type: new Abstract: Video virtual try-on is a highly constrained editing task requiring the precise replacement of a target person's clothing while strictly preserving the original video's spatial structure and temporal dynamics. Existing methods heavi…