MiniMax发布了其H3模型,该模型能够实时生成带有同步音频的视频。该模型基于vLLM-Omni和FastVideo的FastH3构建,可以在8.7秒内渲染一个10.1秒的MP4视频。该公司强调,这是一个开源版本,旨在利用NVIDIA AI硬件,促进社区的进一步发展和改进。 AI
影响 加速实时视频生成能力,并鼓励开源AI的社区驱动改进。
排序理由 Frontier-lab模型发布,附带系统卡。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →