跳到正文
热点事件持续更新

流式语音增强的谱自适应损失研究

1 篇报道1 个报道来源2 小时前 更新

先了解这件事

AI 综述

2026年10月7日,arXiv(Audio and Speech)发表一手论文《面向均衡频谱重建:用于流式语音增强的频谱自适应损失》。论文提出两种频谱加权 STFT 损失函数,用于轻量级流式语音增强,目标是解决由幅度-相位补偿效应引起的中高频幅度过度衰减问题。其中,sigmoid 加权损失对相位感知贡献施加平滑的频率相关调制;频谱自适应损失进一步以真实对数幅度谱图条件化调制。论文还设计轻量骨干 HyST-Net,采用混合 MHA-GRU 谱时建模,以适配低延迟流式场景。目前报道仅涉及论文方法与动机,未见实验结果、对比数据或后续验证信息。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. arXiv · Audio and Speech
    面向均衡频谱重建:用于流式语音增强的频谱自适应损失

    论文提出两种频谱加权 STFT 损失函数,用于轻量级流式语音增强,解决由幅度-相位补偿效应引起的中高频幅度过度衰减。sigmoid 加权损失对相位感知贡献施加平滑的频率相关调制,频谱自适应损失进一步以真实对数幅度谱图条件化调制,并设计轻量骨干 HyST-Net,采用混合 MHA-GRU 谱时建模以适配低延迟流式场景。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。