一位 Reddit 用户分享了 MiniMax Turbo Lora (LIGHTX2V) 的配置,该配置改进了 Ref2V 音频功能。该设置涉及使用 lightx2v turbo lora 配合 MiniMax-H3 turbo 套件的 TurboSampler 节点,sigma 偏移量为 12/3,步数为 6。此配置允许从单个参考图像和与视频内容不同的参考音频样本生成视频。用户通过在配备 4070 ti GPU 和 64GB RAM 的系统上,在 181 秒内生成了一个 1 分 5 秒的视频来演示这一点,未使用 EasyCache 或 Spectrum Apply 节点。 AI
影响 为 MiniMax Turbo Lora (LIGHTX2V) 用户提供了一个特定的配置,以提高 Ref2V 音频生成能力。
排序理由 用户分享的特定 Lora 模型配置。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →