Skip to content
arXiv · Computer Vision· Haozhe Yang, Zhiyang Dou, Zekai Gu, Cheng Lin, Wenping Wang, Yuan Liu, Taku Komura·· 4 hr agoAI score30

TKCAM:基于文本与关键帧的相机轨迹生成

TKCAM: Text and Keyframe to Camera Trajectory Generation

AI brief

TKCAM 是一个文本与关键帧条件相机运动合成框架,基于生成式掩码建模,将位置、速度与连续旋转表示组成的 12 维运动学特征经残差向量量化器(RVQ)离散为分层运动 token。

Source: arXiv · Computer Vision · arxiv.org