跳到正文
原文
arXiv · Computers and Society· Shen Yan, Duc Le, Irina-Elena Veliche·· 7 小时前AI 评分38

HEAR:基于真实人声的大规模音频语言模型偏见基准

HEAR: Real Voices, Real Bias: A Large-Scale Human-Recorded, Demographically Diverse Benchmark for Audio Language Models

AI 导读

HEAR 包含 87k 条真实人声音频样本,来自 843 名具人口统计学多样性的参与者,通过选择题问答和开放式长文本任务评估音频大语言模型。研究发现声音条件偏见是模型特有属性,个性化指令会加剧人口统计学差异。

来源:arXiv · Computers and Society · arxiv.org