arXiv · Audio and Speech· Mengzhe Geng·· 3 小时前AI 评分31
PACT-SLM 合约测试:语音语言模型在何时拥有足够证据采取行动?
When Does a Spoken Agent Have Enough Evidence to Act? The PACT-SLM Contract Test
AI 导读
PACT-SLM 是一项受控评估,为语音语言模型的每个前缀指定首个有效行动时间,并独立测量行动身份与时机。WavLM Base Plus 探针在 1,600 个前缀预测上达到 26.03% 语义标签准确率,在 15 dB 噪声下仍可工作,但行动身份与时机表现分离:时机更精确(36.25%),身份准确率仅 9.92%。
来源:arXiv · Audio and Speech · arxiv.org