arXiv · Computation and Language· Pranav Darshan, Pranav A, Sravan Karthick T, Minal Moharir, Ivan P. Yamshchikov·· 6 小时前AI 评分50
语言模型幻觉检测中的可检测性缺口:隐藏异质性
The Detectability Gap: Hidden Heterogeneity in Hallucination Detection Across Language Models
AI 导读
研究发现基于采样一致性的幻觉检测存在可检测性缺口,高一致(Ghost)与低一致(Flickering)幻觉之间的 AUC 差距为 0.35 到 0.46。冻结 regime 分配后,词汇与语义响应离散度在全部 12 个模型与数据集设置中保持不对称,bootstrap 95% 置信区间不包含零。
来源:arXiv · Computation and Language · arxiv.org