跳到正文
原文
arXiv · Computer Vision· Haozhe Yang, Zhiyang Dou, Zekai Gu, Cheng Lin, Wenping Wang, Yuan Liu, Taku Komura·· 3 小时前AI 评分30

TKCAM:基于文本与关键帧的相机轨迹生成

TKCAM: Text and Keyframe to Camera Trajectory Generation

AI 导读

TKCAM 是一个文本与关键帧条件相机运动合成框架,基于生成式掩码建模,将位置、速度与连续旋转表示组成的 12 维运动学特征经残差向量量化器(RVQ)离散为分层运动 token。

来源:arXiv · Computer Vision · arxiv.org