Flux 1
PulseAugur coverage of Flux 1 — every cluster mentioning Flux 1 across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
AI视频模型:开源替代品每年涌现
用户注意到AI视频模型开发中存在一个反复出现的模式,即开源替代品大约在专有模型发布一年后出现。这种趋势在Luma的闭源模型之后出现了开源的Wan 2.2,以及最近OpenAI的Sora 2之前出现了MiniMax H3。用户还回忆起DALL-E 2和Flux 1之间也存在类似的间隔一年,这凸显了该领域创新的快速步伐。
-
Blue Funnel Line 发布 FLUX 3 多模态模型,赋能机器人控制
Blue Funnel Line 推出了 FLUX 3,一款集成了图像、视频和音频生成能力的新型多模态基础模型。该模型与 mimic robotics 合作进一步开发,创造了 FLUX-mimic,一个能够控制机器人的视频动作模型。FLUX-mimic 已被 Audi 测试并部署,展示了该模型理解和与物理世界交互的能力,将其能力从内容创作扩展到物理人工智能应用。
-
Black Forest Labs 发布 FLUX 3 Video,性能超越 Gemini Omni 和 Grok Imagine
Black Forest Labs 发布了 FLUX 3 Video,这是一款多模态流模型,据称在视频生成能力方面超越了 Gemini Omni 和 Grok Imagine 等现有模型。该模型提供广泛的功能,包括文本到视频、图像到视频、视频到视频生成以及多语言对话,并计划推出开放权重开发者版本。此外,Black Forest Labs 还宣布了 FLUX3-mimic,该模型展示了在工业环境中驱动机器人和预测其影响的能力。
-
用户寻求简便的现代图像模型本地LoRA训练方法
Reddit上的用户正在咨询当前训练自定义模型(特别是LoRA)用于图像生成的现状。他们回忆起使用Flux 1等旧模型时,有一个更简单的过程,可以在小数据集上轻松训练,以获得个性化的人物、动物和风格效果。核心问题是,随着更新、更复杂的图像生成模型出现,这种本地训练的便捷性是否有所下降,以及当前有哪些替代方案可以提供类似的自定义模型创建用户友好体验。
-
NVIDIA 的 PiD 解码器集成到 ComfyUI 中,以增强图像放大
NVIDIA 的像素扩散解码器 (PiD) 方法正通过自定义节点集成到 ComfyUI 中,从而实现解码和放大过程的结合。该方法将潜在图像解码视为条件像素扩散,为更高分辨率提供更高质量。实验性节点支持各种 NVIDIA 检查点,并包含用于降低 VRAM 使用量和文本提示辅助的功能。