arXiv · Audio and Speech· Jingqi Sun, Haozhan Tang, Shulin He, Zhong-Qiu Wang·· 4 hr agoAI score18
VM-ArrayDPS:用虚拟麦克风增强扩散后验采样实现无监督盲语音分离
VM-ARRAYDPS: Virtual Microphone Augmented Diffusion Posterior Sampling for Unsupervised Blind Speech Separation
AI brief
提出 VM-ArrayDPS 方法,通过向麦克风阵列引入更高 SNR 的虚拟麦克风,为 ArrayDPS 的多通道一致性(MC)目标提供额外约束,以改进盲源分离(BSS)。该方法将 BSS 建模为后验采样问题,并用预训练语音扩散模型引导恢复干净源信号。实验显示其在 2 说话人与 3 说话人数据集上显著优于 ArrayDPS,并做了虚拟麦克风数量与 MC 目标权重的消融研究。
Source: arXiv · Audio and Speech · arxiv.org