热点事件持续更新
AVIO:学习在音视频场景中添加与移除发声物体
1 篇报道1 个报道来源6 小时前更新
先了解这件事
AI 综述
AVIO 通过源条件特征调制适配预训练文本到音视频生成模型,联合学习物体添加与移除,并引入参考帧课程逐步减少参考条件以实现仅指令编辑。AVIOBench 数据集包含 37.9 小时、覆盖 1,878 个目标物体名称的配对音视频样本,通过视觉定位与跨模态一致性筛选目标声音移除候选。定量与定性评估表明,AVIO 在音视频物体移除与添加上有效,可选参考引导为添加提供外观与位置控制。
AI 根据报道生成 · 2 小时前更新
报道时间线
沿着报道,了解事件的不同侧面。
9月30日
- arXiv · Artificial IntelligenceAVIO:学习在音视频场景中添加与移除发声物体
AVIO 通过源条件特征调制适配预训练文本到音视频生成模型,联合学习物体添加与移除,并引入参考帧课程逐步减少参考条件以实现仅指令编辑。AVIOBench 数据集包含 37.9 小时、覆盖 1,878 个目标物体名称的配对音视频样本,通过视觉定位与跨模态一致性筛选目标声音移除候选。定量与定性评估表明,AVIO 在音视频物体移除与添加上有效,可选参考引导为添加提供外观与位置控制。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。