arXiv · Computation and Language· Shuai Guo, Yidong Cui·· 4 hr agoAI score30
BeliefScope:诊断大语言模型的证据驱动修正与压力诱导偏移
BeliefScope: Diagnosing Evidence-Driven Revision and Pressure-Induced Shifts in Large Language Models
AI brief
研究提出 BeliefScope,一种受控黑盒框架,用于在固定目标命题下区分证据与方向性用户压力对模型响应变化的影响。框架将 Evidence 与 Pressure 与因子级局部控制交叉,通过概率报告、类别判断和行动推荐测量响应变化,并在受控合成条件下评估可归因性。
Source: arXiv · Computation and Language · arxiv.org