Lilian Weng·· 2024-04-12AI 评分39
Diffusion Models for Video Generation
Diffusion Models for Video Generation
AI 导读
扩散模型已用于图像合成,研究社区正将其扩展到视频生成任务。视频生成是图像的超集,需要在时间维度上保持一致性,并面临高质量视频数据收集困难的问题。Imagen Video 通过级联扩散模型和渐进蒸馏将采样步数减半,Sora 则采用 DiT 架构处理时空块。
来源:Lilian Weng · lilianweng.github.io