PulseAugur
实时 10:29:32
English(EN) OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing

新的OpenVE-3M数据集和OpenVE-Edit模型推动了指令引导视频编辑的发展

研究人员推出了OpenVE-3M,这是一个用于指令引导视频编辑的大规模开源数据集。该数据集包含两大类编辑:空间对齐和非空间对齐,其质量和多样性均超越了现有数据集。为了评估性能,他们还开发了OpenVE-Bench,一个包含431个视频-编辑对的基准测试。在OpenVE-3M数据集上训练的拥有50亿参数的模型OpenVE-Edit,在OpenVE-Bench上取得了最先进的成果,性能优于更大的基线模型。 AI

影响 该数据集和模型推动了指令引导视频编辑的能力和评估,有望改进内容创作工具。

排序理由 该集群描述了一个新的用于视频编辑的学术数据集和基准测试,以及一个在该数据集上训练的模型。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.CV 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

新的OpenVE-3M数据集和OpenVE-Edit模型推动了指令引导视频编辑的发展

报道来源 [1]

  1. arXiv cs.CV TIER_1 English(EN) · Haoyang He, Jie Wang, Jiangning Zhang, Zhucun Xue, Xingyuan Bu, Qiangpeng Yang, Shilei Wen, Lei Xie ·

    OpenVE-3M:用于指令引导视频编辑的大规模高质量数据集

    arXiv:2512.07826v3 Announce Type: replace Abstract: The quality and diversity of instruction-based image editing datasets are continuously increasing, yet large-scale, high-quality datasets for instruction-based video editing remain scarce. To address this gap, we introduce OpenV…