跳到正文
原文
arXiv · Computer Vision· Hongbo Zhang, Zihao Yang, Liuyang Song, Daqian Yang, Haoyang Yao, Yan Wen, Zhengtao Yao·· 3 小时前AI 评分42

Query Independent Variable Rate Visual Token Coding

Query Independent Variable Rate Visual Token Coding

AI 导读

该研究提出一种视觉token压缩方法,通过保留所有token并按整数率失真优化分配固定比特预算,使压缩表示与查询无关。在两个数据集和两种容量下,等比特预算时比均匀速率编码、闭式注水法和失真排序剪枝更好地保留模型输出分布与答案,在跨轮对话或不同问题场景下优于注意力排序剪枝。

来源:arXiv · Computer Vision · arxiv.org