跳到正文
原文
arXiv · Audio and Speech· Soham Ray, Edgard dos Santos Paiva, Ruben Valenzuela, Karthik Narasimhan, Keshav Dhandhania, Victor Barres·· 6 小时前AI 评分58

τ-Multilingual:跨语言语音Agent基准评测

$\tau$-Multilingual: Benchmarking Voice Agents Across Languages

AI 导读

论文提出 τ-Multilingual,将 τ-Voice 扩展至西班牙语、巴西葡萄牙语、印地语、韩语和普通话,并通过母语者评审与评测生成语言和语音输出。在 4,500 次全双工通话和五种语音配置下,西语、葡语和印地语与英语的任务完成度差距在 3.2 分以内,韩语和普通话分别下降 14.7 和 8.4 分;韩语系统更多遗漏回复,普通话系统更多打断,两者均在工具和实体上表现较弱。

来源:arXiv · Audio and Speech · arxiv.org