arXiv · Statistics Machine Learning· David Achara, Maryam Sultana, Alexander D. Rast, Fabio Cuzzolin·· 7 小时前AI 评分25
XU-RS:解释随机集语言模型中的置信宽度
XU-RS: Explaining Credal Width in Random-Set Language Models
AI 导读
XU-RS 框架将答案的置信宽度归因于输入语言模型的 token,使用 Expected Gradients 估计 token 对置信宽度的贡献。在 MedQA 数据集上对 SmolLM3-3B 和 Llama-2-7B 的实验表明,高排名 token 的零掩码比随机零掩码引起更大的置信宽度变化。
来源:arXiv · Statistics Machine Learning · arxiv.org