跳到正文
原文
arXiv · Audio and Speech· Tatsuya Komatsu, Hokuto Munakata·· 3 小时前AI 评分26

重新审视音频时刻检索中的逐帧显著性

Revisiting Frame-Wise Saliency for Audio Moment Retrieval

AI 导读

论文重新审视音频时刻检索(AMR)中的逐帧显著性,证明原本仅作辅助输出的逐帧显著性序列本身即可作为有效的时刻预测来源。作者用一条受 SED 启发的无参数分割规则把显著性序列转换为排序时刻,直接从逐帧时间信息完成检索。

来源:arXiv · Audio and Speech · arxiv.org