跳到正文
热点事件持续更新

Video Evidence Indexing:视频预览学习定位实现Token预算受限的长视频问答

1 篇报道1 个报道来源2 小时前 更新

先了解这件事

AI 综述

2026-10-02,arXiv发表计算机视觉论文,提出Token预算受限的长视频问答方法Video Evidence Indexing(VEI)。该方法先通过低分辨率Video Preview定位问题相关时刻,再构建紧凑高分辨率Evidence Set用于最终推理,以在有限Token预算下提升长视频问答效果。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月2日
  1. arXiv · Computer Vision
    Video Evidence Indexing:基于视频预览学习定位关键片段以实现 Token 预算受限的长视频问答

    论文提出 token-budgeted Video Evidence Indexing(VEI),通过低分辨率 Video Preview 定位问题相关时刻,并构建紧凑高分辨率 Evidence Set 用于最终推理。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。