跳到正文
原文
arXiv · Human-Computer Interaction· Nykko Vitali, Mahzarin R. Banaji·· 6 小时前精选AI 评分62

大语言模型表现出类似人类的贝叶斯伪善

Large Language Models Exhibit Human-Like Bayesian Hypocrisy

AI 导读

arXiv 论文通过 5 个实验、48 个条件、超过 5000 次试验,测试 GPT-4o 和 Claude 3.7 Sonnet 在两种贝叶斯推理任务上的表现。结果显示模型接近人类水平但更规则化、僵化,并且像人类一样、程度更甚地谴责同样使用贝叶斯法则的他人,揭示自我表现与他人判断之间的脱节。

推荐理由

研究揭示大模型在贝叶斯推理任务上表现出与人类相似的双重标准,提示在统计准确性与公平性冲突场景中的使用风险。

来源:arXiv · Human-Computer Interaction · arxiv.org