arXiv · Audio and Speech· Siqing Qin, Kong Aik Lee, Youzhi Tu·· 4 hr agoAI score21
面向语音深度伪造检测域泛化的源导向轨迹扰动方法
Source-Directed Trajectory Perturbation at First-Order Cost for Domain Generalization in Speech Deepfake Detection
AI brief
论文提出 WC-MLDG-2P,一种面向 MLDG 的源导向鲁棒域泛化方法,在保持一阶 MLDG 两次梯度评估成本的同时,把干净的 MLDG 端点移向局部源损失更高的状态并在该处计算 meta-test 梯度。
Source: arXiv · Audio and Speech · arxiv.org