跳到正文
热点事件持续更新

SelfTTS:基于显式解耦与自精炼的跨说话人风格迁移TTS

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026-10-01,arXiv发表Audio and Speech论文,介绍SelfTTS模型。该模型无需外部预训练说话人或情感编码器,通过梯度反转层与余弦相似度损失解耦说话人和情感信息,并引入多正对比学习(MPCL)实现嵌入聚类。模型结合自增强策略与声音转换能力提升合成语音自然度,在情感自然度(eMOS)和目标音色/情感稳定性上优于现有基线。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月1日
  1. arXiv · Audio and Speech
    SelfTTS:通过显式嵌入解耦与自精炼实现跨说话人风格迁移的文本转语音模型

    SelfTTS 是一种无需外部预训练说话人或情感编码器的文本转语音模型,通过梯度反转层与余弦相似度损失解耦说话人和情感信息,并引入多正对比学习(MPCL)实现嵌入聚类。模型利用自增强策略结合声音转换能力提升合成语音的自然度,在情感自然度(eMOS)和目标音色/情感稳定性上优于现有基线。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。