实体
OpenVE-3M
OpenVE-3M
PulseAugur coverage of OpenVE-3M — every cluster mentioning OpenVE-3M across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
新的OpenVE-3M数据集和OpenVE-Edit模型推动了指令引导视频编辑的发展
研究人员推出了OpenVE-3M,这是一个用于指令引导视频编辑的大规模开源数据集。该数据集包含两大类编辑:空间对齐和非空间对齐,其质量和多样性均超越了现有数据集。为了评估性能,他们还开发了OpenVE-Bench,一个包含431个视频-编辑对的基准测试。在OpenVE-3M数据集上训练的拥有50亿参数的模型OpenVE-Edit,在OpenVE-Bench上取得了最先进的成果,性能优于更大的基线模型。
-
Sparkle 数据集和基准推动 AI 视频背景替换技术发展
研究人员推出了 Sparkle,这是一个旨在改进指令引导视频背景替换的新数据集和基准。该数据集包含约 140,000 对视频,涵盖五个主题,解决了高质量训练数据稀缺的问题,而这种稀缺性曾阻碍了 Kiwi-Edit 等先前模型的发展。Sparkle 采用新颖的解耦前景和背景引导合成流程,实现了更自然、时间上更一致的场景切换。实验表明,在 Sparkle 上训练的模型在新的 Sparkle-Bench 和 OpenVE-Bench 上均优于现有基线。