实体
ROPE embeddings
ROPE embeddings
PulseAugur coverage of ROPE embeddings — every cluster mentioning ROPE embeddings across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
Wan-Dancer框架可根据音乐生成分钟级连贯舞蹈视频
研究人员开发了Wan-Dancer,一个新颖的层级框架,能够从音乐生成超过一分钟的连贯舞蹈视频。该方法克服了现有扩散模型的时间限制,这些模型通常在20秒以上就会遇到困难。Wan-Dancer采用了一个两阶段过程,包括全局关键帧规划和局部时间细化,利用时间映射的RoPE嵌入和基于光流的损失函数来确保长程连贯性和运动连续性。该框架支持音频和文本提示的条件约束,展示了在多种舞蹈类型中的通用性,并确立了长篇舞蹈视频合成的新技术水平。
-
新的Style-CCL框架增强了内容保持的风格迁移能力
研究人员开发了Style-CCL,一个利用Diffusion Transformers实现内容保持的风格迁移的新框架。该方法采用课程持续学习方法,首先在语义风格上训练双分支SC-DiT模型,然后训练纹理风格,同时从干净数据进展到合成数据。为了缓解灾难性遗忘,在训练阶段使用了随机记忆回放。实验表明,Style-CCL在风格相似性、内容一致性和美学质量方面优于现有方法。