arXiv · Human-Computer Interaction· David Nadrchal, Monorama Swain, Florian Schmid, Gerhard Widmer, Paul Primus·· 16 小时前AI 评分35
基于人工对话为构音障碍与气管造口说话者定制 ASR
Personalized Automatic Speech Recognition for a Dysarthric and Tracheostomic Speaker using Artificial Conversations
AI 导读
研究发布一套为捷克语构音障碍且经气管造口说话者定制的 ASR 系统,其语音对未受训听众不可理解。公开 33 小时标注数据集,采用新型“人工对话”协议采集;提出基于 Whisper Base 的多阶段训练管线,在标准捷克语、声学模拟气管造口语音与说话者数据上微调。
来源:arXiv · Human-Computer Interaction · arxiv.org