跳到正文
原文
arXiv · Computer Vision· Suguru Onda, Matthew Bailey, Ryan Farrell·· 3 小时前AI 评分29

VLM 微调中语义能力的习得与特化过程研究

Semantic Capability Acquisition and Specialization During Vision-Language Model Fine-Tuning

AI 导读

研究提出轨迹式框架与 Structured Semantic Routing(SSR),在 DFN、MetaCLIP、OpenAI CLIP 六个预训练骨干上追踪 VLM 微调中身份与属性能力的习得、峰值与迁移。

来源:arXiv · Computer Vision · arxiv.org