跳到正文
热点事件持续更新

ReFIT:指令引导的视觉 token 削减框架

1 篇报道1 个报道来源2 小时前 更新

先了解这件事

AI 综述

2026年10月8日,arXiv Computer Vision 频道发布论文,提出 ReFIT,一种面向高效大型视觉语言模型(LVLM)推理的指令引导视觉 token 削减框架,旨在加速图像理解。该框架由两个组件构成:Relevance-Guided Window Reshaping(RWR,相关性引导的窗口重塑)与 Instruction-Guided Token Refinement(ITR,指令引导的 token 精炼)。目前公开信息仅包含框架名称与组成,未披露具体实验数据、基准结果或代码开源情况。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月8日
  1. arXiv · Computer Vision
    ReFIT:面向加速图像理解的自适应视觉 token 削减

    论文提出 ReFIT,一种面向高效 LVLM 推理的指令引导视觉 token 削减框架,由 Relevance-Guided Window Reshaping(RWR)与 Instruction-Guided Token Refinement(ITR)组成。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。