跳到正文
原文
arXiv · Audio and Speech· Xilin Jiang, Qiaolin Wang, Junkai Wu, Xiaomin He, Zhongweiyang Xu, Yinghao Ma, Minshuo Piao, Kaiyi Yang, Xiuwen Zheng, Riki Shimizu, Yicong Chen, Arsalan Firoozi, Gavin Mischler, Sukru Samet Dindar, Richard Antonello, Linyang He, Tsun-An Hsieh, Xulin Fan, Yulun Wu, Yuesheng Ma, Chaitanya Amballa, Weixiong Chen, Jiarui Hai, Ruisi Li, Vishal Choudhari, Cong Han, Yinghao Aaron Li, Adeen Flinker, Mounya Elhilali, Emmanouil Benetos, Mark Hasegawa-Johnson, Romit Roy Choudhury, Nima Mesgarani·· 3 小时前AI 评分36

AVMeme Exam:面向 LLM 上下文与文化知识与思维的多模态多语言跨文化基准

AVMeme Exam: A Multimodal Multilingual Multicultural Benchmark for LLMs' Contextual and Cultural Knowledge and Thinking

AI 导读

研究者推出 AVMeme Exam,一个由人工标注、收录逾千个标志性网络音视频(涵盖语音、歌曲、音乐与音效)的多模态基准,每条 meme 配有一组从表层内容到上下文、情绪、用法与世界知识的 Q&A,并附年份、转录、摘要与敏感度等元数据。

来源:arXiv · Audio and Speech · arxiv.org