SAVER:用稠密参考强化稀疏视频推理
Get the story
2026年10月9日,arXiv 计算机视觉(一手)报道:研究者提出 SAVER,一种稠密到稀疏的视频后训练框架,以稠密视频视图作为训练期参考,通过接地奖励和可靠性门控参考奖励优化稀疏视图预测。SAVER 仅用 1,250 个随机采样的时序接地样本训练,未使用任何视频问答标注。实验显示,在三个时序接地基准和六个视频问答基准上,SAVER 在不同帧数预算下均提升表现,可匹配或超越稠密帧 Qwen3.5 基线,同时使用明显更少的帧。
Generated from reports · updated 3 hr ago
Timeline
Follow the coverage from different angles.
- arXiv · Computer VisionSAVER:用稠密参考强化稀疏视频推理
研究者提出 SAVER,一种稠密到稀疏的视频后训练框架,用稠密视频视图作为训练期参考,以接地奖励和可靠性门控参考奖励优化稀疏视图预测。SAVER 仅用 1,250 个随机采样的时序接地样本训练,未使用任何视频问答标注。在三个时序接地基准和六个视频问答基准上,SAVER 在不同帧数预算下均提升表现,可匹配或超越稠密帧 Qwen3.5 基线,同时使用明显更少的帧。
Heat trend
Current heat 9·Comparable peak 10(Oct 9)·Comparable change over 24 hours –
The trend compares only the same participants observed continuously; its range may be smaller than the current heat count. Move or click on the chart to inspect hourly heat; use the left and right arrow keys to switch.