Hot eventLive
Foveated Compression:token 高效视觉语言模型论文
1 reports1 sources3 hr ago updated
Get the story
AI overview
2026年10月7日,arXiv 计算机视觉频道发布论文《Foveated Compression:面向 token 高效视觉语言模型的选择性高分辨率保留》。该研究提出 Foveated Compression 方法,目标是在固定 token 预算下提升视觉语言模型的效率。其做法是用一次全分辨率编码,混合原生分辨率与压缩分辨率的视觉 token;同时引入 Foveated Merger 与 Foveated Selector,从九个空间格中选择其一保留原生分辨率,其余部分使用压缩分辨率表示。报道未提供实验数据、基准结果或作者信息,也未提及该方法与其他方法的对比。
Generated from reports · updated 3 hr ago
Timeline
Follow the coverage from different angles.
Oct 7, 2026
- arXiv · Computer VisionFoveated Compression:面向 token 高效视觉语言模型的选择性高分辨率保留
研究提出 Foveated Compression,在固定 token 预算下用一次全分辨率编码混合原生与压缩分辨率视觉 token,并借 Foveated Merger 与 Foveated Selector 选择九个空间格之一保留原生分辨率。
Heat trend
There is not enough continuous observation data to draw a trend yet.