跳到正文
原文
arXiv · Information Retrieval· Gunwoo Lee, Changmin Sung, Sang-Hwan Gwak, InA Kim, Ji-Young Choi, Kyong-Ha Lee·· 3 小时前AI 评分20

检索主导抽取式 QA 中内在序列似然置信度的两个预设负例及其归因分析

Intrinsic Sequence-Likelihood Confidence in Retrieval-Dominated Extractive QA: Two Pre-Specified Negatives, and What They Do and Do Not Attribute

AI 导读

在检索主导的抽取式 QA 中,检索已恢复 92-99.8% 的最佳组合准确率,基于 7-9B 模型微调产生的置信度信号作为控制信号未能带来增益。序列似然信号在适应前后均不足,AUC 0.65-0.81,标量重校准与 token 级温度重缩放未一致改善;选择器消融在三个适应组合上无统计显著下游收益,Gemma 移除置信项后由失败转为通过两项注册标准。可用的产出是一组依赖关系明确的预设负例。

来源:arXiv · Information Retrieval · arxiv.org