arXiv · Computation and Language· Shengyu Li, Jinting Wang, Li Liu·· 4 hr agoAI score24
ARIA:面向粤语歌词创作的音频驱动旋律—声调关系建模
ARIA: Audio-Driven Melody-Tone Relation Modeling for Cantonese Lyric Authoring
AI brief
ARIA 是一个两阶段音频驱动框架,从带字符级时间戳的演唱录音生成粤语歌词。它用 TRATE 从时间戳音频预测 0243 序列,再用 DRA-TCLG 基于预测声调方案与检索增强词汇引导生成流畅歌词,并构建大规模音频—粤拼—0243 数据集。实验显示其在 0243 预测与声调一致歌词生成上表现强,论文被 EMNLP 2026 Findings 接收。
Source: arXiv · Computation and Language · arxiv.org