实体
SANA-Video
SANA-Video
PulseAugur coverage of SANA-Video — every cluster mentioning SANA-Video across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
新代理原生框架加速AI视频生成
研究人员开发了Sol Video Inference Engine,一个旨在加速扩散模型视频生成的新型框架。这个代理原生、无需训练的系统通过动态组合五种关键技术来优化性能:缓存、稀疏注意力、令牌修剪、量化和内核融合。通过针对特定模型、硬件和推理配置定制这些方法,Sol实现了超过2倍的速度提升,同时保持了生成质量,这一点在三种不同的视频模型上得到了证明。
-
新算法TASKER改进视频理解和代理任务
研究人员开发了TASKER,一种新颖的关键帧提取算法,旨在提高视频问答(VideoQA)和视频引导代理任务的性能。该算法在一个新论文中进行了详细介绍,它联合考虑任务相关性和场景动态性来识别信息帧。还引入了一个新的基准VG-GUIBench,用于评估多模态大语言模型(MLLMs)遵循视频教程和完成GUI交互任务的能力,证明了TASKER的有效性。