跳到正文
原文
arXiv · Audio and Speech· Mengzhe Geng·· 3 小时前AI 评分31

PACT-SLM 合约测试:语音语言模型在何时拥有足够证据采取行动?

When Does a Spoken Agent Have Enough Evidence to Act? The PACT-SLM Contract Test

AI 导读

PACT-SLM 是一项受控评估,为语音语言模型的每个前缀指定首个有效行动时间,并独立测量行动身份与时机。WavLM Base Plus 探针在 1,600 个前缀预测上达到 26.03% 语义标签准确率,在 15 dB 噪声下仍可工作,但行动身份与时机表现分离:时机更精确(36.25%),身份准确率仅 9.92%。

来源:arXiv · Audio and Speech · arxiv.org