实体
Viacheslav Vasilev
Viacheslav Vasilev
PulseAugur coverage of Viacheslav Vasilev — every cluster mentioning Viacheslav Vasilev across labs, papers, and developer communities, ranked by signal.
总计 · 30天
3
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
3
90 天内 3
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 3 条
-
新的TCVBM框架通过模拟时间相关性来增强视频生成
研究人员推出了一种名为时间相关视频桥接匹配(TCVBM)的新型框架,旨在改进视频生成和处理任务。TCVBM 扩展了现有的桥接匹配模型,以处理时间相关数据序列,这是当前扩散模型难以胜任的能力。通过显式建模序列间依赖关系和时间相关性,TCVBM 在帧插值、图像到视频生成和视频超分辨率方面,与传统方法相比表现出卓越的性能。
-
新方法使文本到音频视频模型能够进行语音克隆
研究人员开发了一种为文本到音频视频(T2AV)生成模型添加语音克隆功能的方法。通过引入一个单一的零初始化线性层并进行微调,T2AV模型可以从简短的参考录音中克隆语音。这种方法在说话人编码器余弦相似度方面显著优于现有的语音克隆文本到语音基线。
-
研究人员通过可编辑的时间和交互式控件增强视频扩散 Transformer
两篇新研究论文介绍了增强视频扩散 Transformer 的控制和交互性的方法。第一篇论文提出了一种时间控制方法,可以在不改变核心架构的情况下,对预训练模型中的运动速度和时间动态进行显式编辑。第二篇论文介绍了 Real-Time AttentionBender,这是一个能够对视频扩散 Transformer 的内部组件进行细粒度、交互式操作的工具,为艺术家提供了对生成过程更深入的理解和创作自主权。