arXiv · Audio and Speech· Shiao Zhu, Lianbo Liu, Kai Washizaki, Koki Nikaido, Yui Sudo·· 4 hr agoAI score31
面向日语 TTS 发音优化的强化学习:用 Kana 域 ASR 奖励替代正字法 CER
Pronunciation-Oriented Reinforcement Learning for Japanese Text-to-Speech with Kana-Domain ASR Rewards
AI brief
该研究提出 Kana-CER,用 kana 转写 ASR 模型与参考读音计算 CER,作为日语 TTS 强化学习后训练的发音奖励,以解决正字法 CER 下不同 kanji 读音坍缩为同一字形的问题。
Source: arXiv · Audio and Speech · arxiv.org