跳到正文
原文
arXiv · Computer Vision· Hong Huang, Chenhongyi Yang, Junzhe Sun, Animesh Sinha, Wuyang Chen, Yifan Jiang·· 3 小时前AI 评分38

Omni-Diffusion-Distill:统一多模态扩散大语言模型的少步数蒸馏

Omni-Diffusion-Distill: Few-Step Distillation of Unified Multimodal Diffusion Large Language Models

AI 导读

Omni-Diffusion-Distill 是一个两阶段蒸馏框架,把统一多模态扩散大语言模型(dLLM)的图像生成从 128 步压缩到 8 步、多模态理解从 512 步压缩到 64 步,分别获得 18.2x 和 21.2x wall-clock 加速。

来源:arXiv · Computer Vision · arxiv.org