arXiv · Audio and Speech· Kwanghee Choi, Eunjung Yeo, Cheol Jun Cho, David Harwath, David R. Mortensen·· 3 小时前AI 评分35
自监督语音模型发现音系向量算术:[b] = [d] - [t] + [p]
[b] = [d] - [t] + [p]: Self-supervised Speech Models Discover Phonological Vector Arithmetic
AI 导读
研究显示,自监督语音模型(S3M)的表示空间中存在与音系特征对应的线性方向,构成音系向量。研究覆盖 96 种语言,发现 [d] 与 [t] 的差可得到浊音向量,将该向量加到 [p] 上可生成 [b],缩放该向量则得到连续的浊音变化。这表明 S3M 以可解释、可组合的音系向量编码语音,即音系向量算术;代码与交互式演示已公开,论文被 ACL 2026 Findings 接收。
来源:arXiv · Audio and Speech · arxiv.org