跳到正文
原文
arXiv · Computation and Language· Shuai Guo, Yidong Cui·· 3 小时前AI 评分30

BeliefScope:诊断大语言模型的证据驱动修正与压力诱导偏移

BeliefScope: Diagnosing Evidence-Driven Revision and Pressure-Induced Shifts in Large Language Models

AI 导读

研究提出 BeliefScope,一种受控黑盒框架,用于在固定目标命题下区分证据与方向性用户压力对模型响应变化的影响。框架将 Evidence 与 Pressure 与因子级局部控制交叉,通过概率报告、类别判断和行动推荐测量响应变化,并在受控合成条件下评估可归因性。

来源:arXiv · Computation and Language · arxiv.org