Skip to content
Hot eventLive

Foveated Compression:token 高效视觉语言模型论文

1 reports1 sources3 hr ago updated

Get the story

AI overview

2026年10月7日,arXiv 计算机视觉频道发布论文《Foveated Compression:面向 token 高效视觉语言模型的选择性高分辨率保留》。该研究提出 Foveated Compression 方法,目标是在固定 token 预算下提升视觉语言模型的效率。其做法是用一次全分辨率编码,混合原生分辨率与压缩分辨率的视觉 token;同时引入 Foveated Merger 与 Foveated Selector,从九个空间格中选择其一保留原生分辨率,其余部分使用压缩分辨率表示。报道未提供实验数据、基准结果或作者信息,也未提及该方法与其他方法的对比。

Generated from reports · updated 3 hr ago

Timeline

Follow the coverage from different angles.

Oct 7, 2026
  1. arXiv · Computer Vision
    Foveated Compression:面向 token 高效视觉语言模型的选择性高分辨率保留

    研究提出 Foveated Compression,在固定 token 预算下用一次全分辨率编码混合原生与压缩分辨率视觉 token,并借 Foveated Merger 与 Foveated Selector 选择九个空间格之一保留原生分辨率。

Heat trend

There is not enough continuous observation data to draw a trend yet.