实体
Qwen-Video-Edit
Qwen-Video-Edit
PulseAugur coverage of Qwen-Video-Edit — every cluster mentioning Qwen-Video-Edit across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天
2 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
Qwen-Video-Edit 重新利用图像模型实现基于指令的视频编辑
研究人员开发了 Qwen-Video-Edit,一种新颖的基于指令的视频编辑方法,该方法重新利用了现有的图像编辑模型。该方法通过将视频-VAE 的潜在表示投影到 DiT 的 token 空间,来教会 Qwen-Image-Edit transformer 直接操作视频-VAE 的潜在表示。该模型使用指令三元组进行微调,然后通过去噪增强进行优化,使其能够根据文本命令执行编辑。
-
新数据集和框架推动图像和视频编辑能力发展
研究人员开发了多个新的数据集和框架,以推动图像和视频编辑能力的进步。OpenGPT-4o-Image 是一个大规模数据集,采用新颖的方法,结合分层任务分类和自动生成,创建指令-图像对,以提高多模态 AI 性能。CPI-Bench 为真实世界的图像编辑提供了一个全面的基准,评估多图像任务、实际应用和基于推理的编辑,以更好地区分模型性能。SI-Edit 引入了一个用于草图指令引导的局部图像编辑的数据集和框架,具有像素级精度,而 Conce…