Skip to content
arXiv · Computer Vision· Hong Huang, Chenhongyi Yang, Junzhe Sun, Animesh Sinha, Wuyang Chen, Yifan Jiang·· 4 hr agoAI score38

Omni-Diffusion-Distill:统一多模态扩散大语言模型的少步数蒸馏

Omni-Diffusion-Distill: Few-Step Distillation of Unified Multimodal Diffusion Large Language Models

AI brief

Omni-Diffusion-Distill 是一个两阶段蒸馏框架,把统一多模态扩散大语言模型(dLLM)的图像生成从 128 步压缩到 8 步、多模态理解从 512 步压缩到 64 步,分别获得 18.2x 和 21.2x wall-clock 加速。

Source: arXiv · Computer Vision · arxiv.org