跳到正文
原文
arXiv · Computer Vision· Zizhao Li, Mohammed Yaqoob Ansari, Xinyu Su, Jiayang Ao, Joseph West, Kourosh Khoshelham·· 7 小时前AI 评分52

You Only Reprogram Once:重新思考视觉重编程的长训练

You Only Reprogram Once: Rethinking Prolonged Training for Visual Reprogramming

AI 导读

论文提出 YORO 方法,利用冻结模型的响应空间通过单次前向遍历构建下游预测器,无需反向传播或优化器更新;贝叶斯判别映射(BDM)基于流式类统计推导协方差感知仿射映射。在三个全数据设置上平均精度较最强无梯度映射提升 18.4–24.4%,16-shot CLIP 四骨干平均从 71.4% 提升至 77.2%。YORO-FP 可选对视觉提示再优化 20 轮,验证时常保留单次预测器。

来源:arXiv · Computer Vision · arxiv.org