跳到正文
原文
arXiv · Computer Vision· Byoungwoo Park, Jaemoo Choi, Juho Lee, Yongxin Chen·· 3 小时前AI 评分37

LongTake:学习在长视频生成中维持动态一致性

LongTake: Learning to Sustain Dynamics in Long-Horizon Video Generation

AI 导读

LongTake 提出两阶段训练流程,基于长视频教师强制(Long-Horizon TF)扩展自回归视频扩散模型的监督范围。在相同 5 秒 DMD 训练设定下,LongTake 在 30 秒自回归生成中取得更高动态度与可比美学质量;Hybrid DMD 进一步将教师监督延伸至后续帧,在 30 秒与 60 秒自回归生成中均达到最高动态度。

来源:arXiv · Computer Vision · arxiv.org