跳到正文
热点事件持续更新

AVIO:学习在音视频场景中添加与移除发声物体

1 篇报道1 个报道来源6 小时前更新

先了解这件事

AI 综述

AVIO 通过源条件特征调制适配预训练文本到音视频生成模型,联合学习物体添加与移除,并引入参考帧课程逐步减少参考条件以实现仅指令编辑。AVIOBench 数据集包含 37.9 小时、覆盖 1,878 个目标物体名称的配对音视频样本,通过视觉定位与跨模态一致性筛选目标声音移除候选。定量与定性评估表明,AVIO 在音视频物体移除与添加上有效,可选参考引导为添加提供外观与位置控制。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

9月30日
  1. arXiv · Artificial Intelligence
    AVIO:学习在音视频场景中添加与移除发声物体

    AVIO 通过源条件特征调制适配预训练文本到音视频生成模型,联合学习物体添加与移除,并引入参考帧课程逐步减少参考条件以实现仅指令编辑。AVIOBench 数据集包含 37.9 小时、覆盖 1,878 个目标物体名称的配对音视频样本,通过视觉定位与跨模态一致性筛选目标声音移除候选。定量与定性评估表明,AVIO 在音视频物体移除与添加上有效,可选参考引导为添加提供外观与位置控制。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。