研究人员推出了RefVideo-6M,这是一个旨在改进视频编辑模型的新型大规模数据集。该数据集通过使用真实、无伪影的视频作为编辑目标,并结合视觉参考和文本指令,解决了现有数据集的局限性。RefVideo-6M包含500万个视频编辑样本和100万个图像编辑样本,旨在提供更可靠的监督,并能够训练出更强大、更可控的编辑模型。 AI
影响 该数据集可能带来更复杂、更可控的AI驱动的视频编辑工具。
排序理由 该集群描述了一个通过学术预印本服务器(arXiv)发布的新数据集和相关模型。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →