跳到正文
原文
arXiv · Computer Vision· Yunjiao Zhou, Junlang Qian, Gen Li, Xinying Guo, Lihua Xie, Jianfei Yang·· 16 小时前AI 评分28

重思固定时间网格:频率解耦的人体运动生成

Rethinking Fixed Temporal Grids: Frequency-Disentangled Motion Generation

AI 导读

论文提出 FreqMo,一种尺度自适应的运动表征,将运动分解为小波频段以分离不同时间尺度的动态,同时保留时间定位与精确重建。配合统一频率残差量化(UFRQ),所有频段在单一共享码本中编码,将 token 序列压缩至三分之一并支持稳定的单阶段生成。实验显示 FreqMo 达到 SOTA 保真度并显著改善高频保留,该分解同样可迁移到连续扩散模型骨干。

来源:arXiv · Computer Vision · arxiv.org