arXiv · Audio and Speech· Tsubasa Ochiai, Marc Delcroix, Nahomi Kusunoki, Rintaro Ikeshita, Naohiro Tawara, Naoyuki Kamo, Tetsuji Ogawa, Shoko Araki·· 3 小时前AI 评分42
提升预测 MOS 分数而非感知质量:语音增强的多预测器测试时优化
Improving Predicted MOS Scores, Not Perceived Quality: Multi-Predictor Test-Time Optimization of Enhanced Speech
AI 导读
研究首次对语音增强任务进行测试时优化,直接修改增强信号以提高多个 MOS 预测器的平均分。在 URGENT 2026 挑战的 7 个系统上,所有优化后的预测分数上升,但基于参考的指标几乎不变,MUSHRA 主观听测未发现感知质量提升。优化可能扭曲系统间的客观比较,建议用于优化的预测器不应同时用于评估,且排行榜应隐藏所用预测器。
来源:arXiv · Audio and Speech · arxiv.org