热点事件持续更新
流式语音增强的谱自适应损失研究
1 篇报道1 个报道来源2 小时前 更新
先了解这件事
AI 综述
2026年10月7日,arXiv(Audio and Speech)发表一手论文《面向均衡频谱重建:用于流式语音增强的频谱自适应损失》。论文提出两种频谱加权 STFT 损失函数,用于轻量级流式语音增强,目标是解决由幅度-相位补偿效应引起的中高频幅度过度衰减问题。其中,sigmoid 加权损失对相位感知贡献施加平滑的频率相关调制;频谱自适应损失进一步以真实对数幅度谱图条件化调制。论文还设计轻量骨干 HyST-Net,采用混合 MHA-GRU 谱时建模,以适配低延迟流式场景。目前报道仅涉及论文方法与动机,未见实验结果、对比数据或后续验证信息。
AI 根据报道生成 · 2 小时前更新
最新进展10月7日 12:00
arXiv新论文提出两种频谱加权STFT损失及轻量骨干HyST-Net,面向流式语音增强。报道时间线
沿着报道,了解事件的不同侧面。
10月7日
- arXiv · Audio and Speech面向均衡频谱重建:用于流式语音增强的频谱自适应损失
论文提出两种频谱加权 STFT 损失函数,用于轻量级流式语音增强,解决由幅度-相位补偿效应引起的中高频幅度过度衰减。sigmoid 加权损失对相位感知贡献施加平滑的频率相关调制,频谱自适应损失进一步以真实对数幅度谱图条件化调制,并设计轻量骨干 HyST-Net,采用混合 MHA-GRU 谱时建模以适配低延迟流式场景。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。