跳到正文
原文
arXiv · Computation and Language· Riju Marwah, Ritvik Garimella, Khusham Bansal, Atishay Jain, Amit Sheth·· 16 小时前AI 评分39

多语言提示词污染下的输出语言混淆研究

Output Language Confusion under Multilingual Prompt Contamination

AI 导读

研究提出 Multilingual Distractor Interference(MDI)评测协议,在 TruthfulQA 与 TriviaQA 上对 5 款指令微调 LLM 进行 40,000 次评测。

来源:arXiv · Computation and Language · arxiv.org