跳到正文
原文
arXiv · Computation and Language· Tiezheng Yu, Yuxin Jiang, Jinpeng Li, Shuning Sun, Fei Mi, Haoli Bai, Lifeng Shang·· 16 小时前AI 评分42

HARPO:面向忠实与创造性语言生成的幻觉感知强化学习框架

HARPO: Hallucination-Aware Reinforcement Learning for Faithful and Creative Language Generation

AI 导读

HARPO 是一种强化学习框架,通过幻觉感知生成奖励模型 HA-GRM 与选择性激活机制 SAM,在大语言模型中同时优化忠实性与创造性。基于 Qwen3-4B 的 HA-GRM 在 RAGTruth 上取得 78.08% 的 response-level F1,高于 SFT 基线的 66.37%。

来源:arXiv · Computation and Language · arxiv.org