跳到正文
原文
arXiv · Computer Vision· Yuanwei Hu, Bo Peng, Yuheng Jia, Xinting Hu, Yadan Luo, Wenjie Zhu·· 7 小时前AI 评分22

VLM4Cluster:预训练视觉-语言模型时代的深度聚类基准

VLM4Cluster: Benchmarking Deep Clustering In the Era of Vision-Language Pre-training

AI 导读

VLM4Cluster 是一个涵盖 17 种方法、20 个数据集的图像聚类基准,系统评估了语言辅助聚类(LaIC)在对抗鲁棒性、分布外泛化与计算效率上的表现。研究显示 LaIC 在语义密集基准上显著提升聚类性能,泛化能力更强、效率更优,但在大规模与细粒度数据集上增益不稳定,且未系统降低对抗扰动敏感性。

来源:arXiv · Computer Vision · arxiv.org