Skip to content
arXiv · Audio and Speech· Jinghan Peng, Yu Zheng, Weiqiang Wang, Jian Liu·· 1d agoAI score21

跨语种说话人验证:自监督预训练模型研究

Cross-Lingual Speaker Verification with Self-Supervised Pre-Trained Models

AI brief

研究利用大规模自监督预训练模型(PTMs)作为前端特征提取器,学习与语言无关的说话人表征,以解决语言不匹配下的说话人验证性能退化问题。系统在 TidyVoice2026 基准上验证,tv26_eval-A 与 tv26_eval-U 的等错误率(EER)分别为 2.21% 和 2.99%。论文入选 Interspeech2026。

Source: arXiv · Audio and Speech · arxiv.org