跳到正文
原文
arXiv · Computer Vision· Duowen Chen, Jinjin He, Gouthaman KV, Sandeep Bangalore Venkatesh, Bo Zhu·· 3 小时前AI 评分42

Audible World Models:面向 3D 世界的空间感知声音生成

Audible World Models: Spatially Aware Sound Generation for 3D Worlds

AI 导读

Audible World Models 是一种无需训练的新框架,能为文本和图像驱动生成的 3D 世界注入空间音频。系统从文本提示构建全景 3D 代理,按语义层分割,识别发声前景物体与环境背景,为每个声音标签合成干音频,并基于重建几何体与几何声学传播渲染与听者位置相关的空间音频。

来源:arXiv · Computer Vision · arxiv.org