跳到正文
原文
arXiv · Computation and Language· Mamehgol Yousefi, Ahmad Shahi, Mos Sharifi, Alvaro Romera, Simon Hoermann, Tham Piumsomboon·· 7 小时前AI 评分25

提示词扰动对大型语言模型偏见与幻觉的影响评估

Evaluating the Effects of Prompt Perturbation on Bias and Hallucination in Large Language Models

AI 导读

研究评估了 LLM 在决策任务中对扰动提示词的鲁棒性,发现扰动在某些模型上可缓解偏见与幻觉。Claude 3 在多数数据集任务中表现更优,GPT-3.5 则表现不稳定。研究强调对 LLM 助手需进行严格测试与验证以确保可靠性。

来源:arXiv · Computation and Language · arxiv.org