一个名为 Video Delta Net (VDN) 的新开源视频生成模型已被推出,它利用混合注意力机制进行高质量的文本到视频生成。VDN 显著加速了 Minimax-H3 模型,速度提高了 75-90 倍,仅用 11 秒和 8 块 NVIDIA B200 GPU 就能生成 14 秒的 768p 视频。该项目旨在实现近乎无损的质量,并已在 Hugging Face 上发布。 AI
影响 加速开源视频生成,可能实现实时或近实时应用。
排序理由 新的开源模型发布,包含技术细节和性能指标。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →