跳到正文
原文
Amazon Science·· 2026-08-27精选AI 评分62

当 LLM 评判者一致时,我们该相信吗:基于 Ising 模型的依赖感知聚合方法

When LLM judges agree, should we believe them?

AI 导读

Amazon Science 提出基于 Ising 模型的依赖感知聚合方法,在相关性、毒性、摘要三任务上相对加权多数投票提升 9%–14%。该方法通过建模评判者之间的成对依赖关系,在无监督设置下利用评估日志中的同意与分歧模式调整聚合权重。

推荐理由

原文给出了依赖感知聚合方法与多数投票的对比结果,读者可据此判断是否需要重新审视现有 LLM-as-a-judge 评估流程。

来源:Amazon Science · amazon.science