FastVideo发布了其FastH3模型的预览版,该模型能够根据文本提示生成同步的视频和音频。该模型采用DMD2和VSA-H3的无数据训练方法,每次生成需要四次Transformer前向计算。预览版支持文本到音频视频生成,可通过GitHub安装,并列出了最佳性能所需的特定硬件和软件要求。 AI
影响 此发布为从文本生成同步视频和音频提供了一个新工具,可能影响创意工作流程和媒体制作。
排序理由 来自知名AI实验室(FastVideo)的模型发布。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
在 Hugging Face Trending Models 阅读 →
- FastH3-4-step-Preview-v1-VSA-DataFree
- FastVideo
- MiniMax
- MiniMax H3
- Nuva Lab
- NVIDIA
- NVIDIA FastGen
- vLLM
- VSA-H3
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →