跳到正文
原文
arXiv · Audio and Speech· Eric Ming Chen, Jin Woo Lee, Vincent Sitzmann·· 5 小时前AI 评分50

可微分声学仿真重建声道

Reconstructing the Vocal Tract with Differentiable Acoustic Simulation

AI 导读

论文提出可微分且 GPU 加速的声道声学模拟器,通过梯度下降从声音重建声道形状。技术贡献包括频域流体公式(比时域有限差分并行度高 70 倍)、可微分湍流模型以及神经网络参数化几何。实验覆盖 11 语言的自监督声道编码,以及与 MRI 生成模型耦合实现无配对数据的动态声道重建。

来源:arXiv · Audio and Speech · arxiv.org