跳到正文
原文
arXiv · Multiagent Systems· Joss Armstrong·· 3 小时前AI 评分38

MARGIN:多智能体基础模型协同的运行时置信度校准

MARGIN: Runtime Confidence Calibration for Multi-Agent Foundation Model Coordination

AI 导读

论文提出 MARGIN(Multi-Agent Runtime Grading via Incremental Normalisation),一种运行时校准方法,可从观测到的答案结果中学习各模型特定的置信度修正,无需重新训练模型或预留校准集。

来源:arXiv · Multiagent Systems · arxiv.org