一款名为 LynnReal-Omni 的新型多模态扩散 Transformer 模型已发布,该模型构建于 Minmax H3 架构之上。该模型将文本到视频、图像到视频、姿势引导生成和视频编辑等各种视频生成任务统一到一个框架中。专门的“Flash”版本提供了显著更快的生成速度,能够实现近乎实时的视频创作。 AI
影响 该模型在视频生成方面的统一方法及其快速的“Flash”版本可能会加速实时视频创作应用。
排序理由 发布了一款新的多模态扩散 Transformer 模型,具有特定的架构细节和性能声明。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →