arXiv · Computer Vision· Haozhe Yang, Zhiyang Dou, Zekai Gu, Cheng Lin, Wenping Wang, Yuan Liu, Taku Komura·· 4 hr agoAI score30
TKCAM:基于文本与关键帧的相机轨迹生成
TKCAM: Text and Keyframe to Camera Trajectory Generation
AI brief
TKCAM 是一个文本与关键帧条件相机运动合成框架,基于生成式掩码建模,将位置、速度与连续旋转表示组成的 12 维运动学特征经残差向量量化器(RVQ)离散为分层运动 token。
Source: arXiv · Computer Vision · arxiv.org