Skip to content
arXiv · Computation and Language· Shuqing Shi, Ziyan Wang, Milind Tambe, Yali Du·· 4 hr agoAI score30

HARP:基于显式偏好推断的异构偏好大语言模型编排

Large Language Model Orchestration under Heterogeneous Preferences via Explicit Persona Inference

AI brief

研究者提出 HARP 框架,把每个智能体的私有偏好从提示词中移出,为每个智能体在有限候选偏好集上维护一个数值后验,并按贝叶斯规则闭式更新;语言模型只提供动作和逐候选似然,使估计与推理解耦。

Source: arXiv · Computation and Language · arxiv.org