跳到正文
热点事件持续更新

视频世界模型对隐藏物体的保持能力研究

1 篇报道1 个报道来源2 小时前 更新

先了解这件事

AI 综述

2026年10月7日,arXiv Computer Vision 发布一手研究《视频世界模型对隐藏物体保留了什么:追踪不等于永久存在》。研究使用冻结的 V-JEPA 2 预测器隐藏物体,并比较其预测与编码器表征。结果显示:静止物体仅被部分保留;被容器携带的物体完全不被保留;移动物体在 0.3 秒内丢失。作为对照,V-JEPA 自身 tube mask 下保留至 0.5 秒,ViT-H 在 90% 掩码率下保留至 1.1 秒。研究据此表明,视频世界模型对隐藏物体的保持并不等同于永久存在,追踪能力与持续表征能力存在差异。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. arXiv · Computer Vision
    视频世界模型对隐藏物体保留了什么:追踪不等于永久存在

    研究以冻结的 V-JEPA 2 预测器隐藏物体,比较其预测与编码器表征:静止物体仅部分保留,被容器携带的物体完全不保留,移动物体在 0.3 秒内丢失(V-JEPA 自身 tube mask 下 0.5 秒,ViT-H 在 90% 掩码率下保留至 1.1 秒)。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。