arXiv · Computer Vision· Yu Yuan, Yawen Lu, Guoxian Song, Kevin Duarte, Ratheesh Kalarot, Di Chang, Xijun Wang, Stanley H. Chan·· 7 小时前AI 评分31
Reimagine Video Dynamics:解耦视频动态与视觉上下文的可编辑动力学 Token 框架
Reimagine Video Dynamics
AI 导读
summary_zh: Reimagine Video Dynamics(RVD)通过自监督重建从视觉上下文中解耦出可编辑的动力学 Token,以第一帧作为视觉上下文、由渲染器从动力学 Token 恢复原视频来捕捉场景演化。
来源:arXiv · Computer Vision · arxiv.org