跳到正文
原文
arXiv · Computer Vision· Hong Huang, Yuqiu Liu, Chenyu You, Daniel Martin, Chuhang Zou, Wuyang Chen·· 3 小时前AI 评分37

Fluid-Gen-Zero:免训练将预训练视频生成器 grounded 于物理

Fluid-Gen-Zero: Grounding Pretrained Video Generators in Physics without Training

AI 导读

Fluid-Gen-Zero 是一个免训练框架,把物理推理与外观合成解耦,用物理模拟器负责运动动力学,同时保留预训练视频生成器的外观建模能力。它通过两级智能体工作流连接两个领域:生成时规划由 VLM 智能体解析意图与模拟 rollout 来组织生成片段,以及在潜空间通过区域感知潜包裹把模拟信号注入去噪。

来源:arXiv · Computer Vision · arxiv.org