arXiv · Computer Vision· Hong Huang, Chenhongyi Yang, Junzhe Sun, Animesh Sinha, Wuyang Chen, Yifan Jiang·· 3 小时前AI 评分38
Omni-Diffusion-Distill:统一多模态扩散大语言模型的少步数蒸馏
Omni-Diffusion-Distill: Few-Step Distillation of Unified Multimodal Diffusion Large Language Models
AI 导读
Omni-Diffusion-Distill 是一个两阶段蒸馏框架,把统一多模态扩散大语言模型(dLLM)的图像生成从 128 步压缩到 8 步、多模态理解从 512 步压缩到 64 步,分别获得 18.2x 和 21.2x wall-clock 加速。
来源:arXiv · Computer Vision · arxiv.org