实体
ViDiHand
ViDiHand
PulseAugur coverage of ViDiHand — every cluster mentioning ViDiHand across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
新的AI模型增强了单目视频生成和手部运动跟踪 · 跟踪3个来源
研究人员开发了新的方法来生成单目视频,这些视频能够准确捕捉手部与物体交互(HOI)以及世界空间中的手部运动。Exo2EgoHOI 通过使用4D先验和注意力机制将外视角视频转换为单视角视图,专注于保留HOI。InfiniHand 提供了一个端到端的流式框架,用于从非校准的单目视频中实时估计手部运动,整合了手部几何和相机运动。EgoFound3R 提供了一个统一的模型,用于在单次通过中估计世界空间手部几何和交互属性,显著提高了吞吐量和准确性。
-
新研究探索使用扩散模型进行先进的视频生成和处理
研究人员正在探索使用扩散模型来改进视频生成和处理的先进技术。一种方法是将状态空间模型(SSM)与视频扩散模型集成,以提高效率并处理更长的序列,在内存使用和性能方面优于基于注意力的方法。其他研究则侧重于通过使用扩散 Transformer 和自适应来提高视频重新照明中的时间一致性,并通过利用预训练的视频扩散模型从视频中重建 4D 手部运动。此外,还在开发用于高效视频恢复和鲁棒点跟踪的方法,方法是调整扩散模型的特征和训练策略。