FastVideo
PulseAugur coverage of FastVideo — every cluster mentioning FastVideo across labs, papers, and developer communities, ranked by signal.
3 天有情绪数据
-
FastVideo的FastH3视频生成模型现已可在消费级硬件上运行
FastVideo发布了FastH3,一个可以根据文本提示生成高清视频的新模型。该模型能够运行在单台消费级机器上,使得先进的视频生成更加易于获取,这一点尤为值得关注。FastH3可在Hugging Face和GitHub上获取,并提供文档和示例。
-
FastVideo发布开源权重FastH3 V2用于视频生成
FastVideo团队发布了FastH3 V2,一个用于视频生成的开源权重模型。新版本提供了改进的功能,并包含文本到视频和图像到视频生成的流程。此次发布提供了Hugging Face的模型权重链接和GitHub的ComfyUI工作流模板链接,便于将其集成到现有的视频创作流程中。
-
MiniMax AI 发布开源 H3 视频模型更新
MiniMax AI 发布了其 H3 视频生成模型的开源更新,强调社区贡献和加速进步。更新包括 FastH3,可在 DGX Spark 和 Apple Silicon 上运行;以及 Sol-H3,一个可在 7 秒内生成带音频的 768p 视频的流水线。其他进展包括用于更快推理的 VDN 和集成到 ComfyUI 中的 PDD,所有这些都旨在使 H3 对开发人员来说更易于访问和更快。
-
MiniMax AI 在消费级硬件上实现本地高质量视频生成
MiniMax AI 已宣布其Fast H3视频生成模型现在可以在消费级硬件上本地运行。此次更新通过MLX将高质量视频生成带到了使用NVIDIA DGX Spark或Apple Silicon的设备上。该公司声称与基础H3模型相比,本地生成速度提高了8倍,使用户能够以1344x768的分辨率创建15秒的片段。
-
MiniMax发布开源H3模型,用于实时视频生成
MiniMax发布了其H3模型,该模型能够实时生成带有同步音频的视频。该模型基于vLLM-Omni和FastVideo的FastH3构建,可以在8.7秒内渲染一个10.1秒的MP4视频。该公司强调,这是一个开源版本,旨在利用NVIDIA AI硬件,促进社区的进一步发展和改进。
-
FastVideo 发布 FastH3 源代码以实现无限直播
FastVideo 发布了其 FastH3 技术的源代码,实现了无限直播。这一开发支持持续的视频生成和流媒体传输,可能影响实时内容创作和分发。
-
ComfyUI 用户通过 H3 LoRA 转换器获得更快、更好的视频
一位用户为 FastVideo 的 H3 LoRA 开发了一个转换器,该转换器因原始模型与 ComfyUI 的重新打包版本之间的命名差异而在 ComfyUI 中无法正常工作。该转换器允许使用 LoRA,从而使视频生成速度提高约 3 倍,视觉质量得到改善,背景、光照和面部连贯性方面细节更好。用户建议使用转换后的 LoRA 配合 6 步以获得最佳效果,并指出原始的 4 步配置会导致不良的伪影。
-
FastVideo 发布开源 FastH3 V1 视频生成模型
FastVideo 团队发布了 FastH3 V1,这是一个用于视频生成的开源检查点和 LoRA。该版本专注于速度和质量,在 B200 GPU 上进行了超过 1000 小时的训练。FastH3 V1 支持可变分辨率、宽高比和时长,并且团队计划为本地 AI 硬件和新的训练方法发布进一步的优化。
-
FastVideo发布FastH3预览版,用于文本到音频视频生成
FastVideo发布了其FastH3模型的预览版,该模型能够根据文本提示生成同步的视频和音频。该模型采用DMD2和VSA-H3的无数据训练方法,每次生成需要四次Transformer前向计算。预览版支持文本到音频视频生成,可通过GitHub安装,并列出了最佳性能所需的特定硬件和软件要求。
-
FastWan-QAD在消费级GPU上以1.8秒生成5秒视频片段
Fastvideo团队发布了FastWan-QAD,这是一种能够在RTX 5090上仅用1.8秒就生成5秒视频片段的新模型。这比以前的方法快了三倍多。该模型有三个版本,针对不同的消费级GPU进行了优化,包括支持缺少FP4张量核心的显卡版本。
-
Dreamverse OSS 支持实时 1080p 视频生成
FastVideo 团队发布了 Dreamverse,这是一个用于实时 1080p 视频生成和编辑的开源项目。该项目包含后端和前端组件,允许用户自行托管该应用程序。虽然可以在云 GPU 提供商上运行,但该团队也在努力集成一个可以在 RTX 5090 等消费级硬件上运行的更小模型。