跳到正文
原文
arXiv · Computer Vision· Haiming Zhao, Tai Wang, Kun Zhang, Xicheng Peng, Zhiyang Li·· 3 小时前AI 评分25

Concept Driven Domain Adaptation:如何在纪录片中检索抽象概念

Concept Driven Domain Adaptation: Finding an Abstract Needle in a Haystack

AI 导读

CDDA 是一个三阶段框架,通过将概念作为中间语义锚点,将两塔视觉语言模型适配到概念级视频检索,在中学物理检索基准上优于 Qwen3-VL-Embedding-2B 等多模态基线。

来源:arXiv · Computer Vision · arxiv.org