跳到正文
原文
arXiv · Computer Vision· Jin Hyun, Jung Gyu Min, Gyuhyun Jung, Youngjoo Lee·· 16 小时前AI 评分25

CHASE-VLA:面向视觉-语言-动作模型的块感知尺度估计训练后量化框架

CHASE-VLA: Post-Training Quantization Framework for Vision-Language-Action Models with Chunk-Aware Scale Estimation

AI 导读

CHASE-VLA 提出一种块感知训练后量化(PTQ)方法,利用已生成动作块(含未执行后缀)结合去噪步分组信息自适应调整动作专家(AE)激活尺度,在无需修改预训练策略的情况下对 AE 的 MLP 与注意力投影实现 W4A4 量化。

来源:arXiv · Computer Vision · arxiv.org