跳到正文
原文
arXiv · Computer Vision· FangZhi Zhong, Xuerui Qiu, Yuqi Pan, Ya Liu, Shaowei Gu, Bo Xu, Guoqi Li·· 7 小时前AI 评分42

FocusVTC:通过自适应分辨率实现高效高视觉文本压缩

FocusVTC: Efficient and High-Performance Visual Text Compression with Adaptive Resolution

AI 导读

FocusVTC 通过自适应分辨率打破视觉文本压缩中低 DPI 节省 token 与高 DPI 影响可读性的权衡,结合压缩低 DPI 全局视图与选择性区域增强。

来源:arXiv · Computer Vision · arxiv.org