Skip to content
arXiv · Human-Computer Interaction· Nykko Vitali, Mahzarin R. Banaji·· 9d agoSelectedAI score62

大语言模型表现出类似人类的贝叶斯伪善

Large Language Models Exhibit Human-Like Bayesian Hypocrisy

AI brief

arXiv 论文通过 5 个实验、48 个条件、超过 5000 次试验,测试 GPT-4o 和 Claude 3.7 Sonnet 在两种贝叶斯推理任务上的表现。结果显示模型接近人类水平但更规则化、僵化,并且像人类一样、程度更甚地谴责同样使用贝叶斯法则的他人,揭示自我表现与他人判断之间的脱节。

Why it matters

研究揭示大模型在贝叶斯推理任务上表现出与人类相似的双重标准,提示在统计准确性与公平性冲突场景中的使用风险。

Source: arXiv · Human-Computer Interaction · arxiv.org