跳到正文
原文
arXiv · Artificial Intelligence· Liner Xiang, Wenbo Zhang, Hengrui Cai·· 5 小时前AI 评分38

OTROPE:基于最优传输的大语言模型鲁棒离线策略评估

OTROPE: Optimal Transport-based Robust Off-policy Evaluation for Large Language Models

AI 导读

OTROPE 提出一种无似然函数的离线评估方法,通过最优传输在语义空间对齐行为模型与目标模型的分布,结合校正后的人工标注残差与代理预测器实现双重鲁棒估计。理论分析解释了基线评估器在分布偏移下失效的原因,并在合成与真实 LLM 评测任务上验证其优于基线,使较弱评估器可接近或超越较强评估器。代码已开源。

来源:arXiv · Artificial Intelligence · arxiv.org