一位 Reddit 用户正在询问在 StableDiffusion 生态系统中专门为声音生成训练 Lora 模型的可行性。目标是将标志性声音(例如《辛普森一家》或经典广播的声音)与图像到视频 (I2V) 适配器一起使用。用户担心为声音训练 character Lora 是否也会无意中改变生成角色的视觉外观,可能将其变形以使其看起来像声音的来源角色。 AI
排序理由 论坛上的用户生成内容,讨论 AI 模型的特定技术应用,而非主要发布或重大行业事件。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →