arXiv · Computation and Language· Tiezheng Yu, Yuxin Jiang, Jinpeng Li, Shuning Sun, Fei Mi, Haoli Bai, Lifeng Shang·· 16 小时前AI 评分42
HARPO:面向忠实与创造性语言生成的幻觉感知强化学习框架
HARPO: Hallucination-Aware Reinforcement Learning for Faithful and Creative Language Generation
AI 导读
HARPO 是一种强化学习框架,通过幻觉感知生成奖励模型 HA-GRM 与选择性激活机制 SAM,在大语言模型中同时优化忠实性与创造性。基于 Qwen3-4B 的 HA-GRM 在 RAGTruth 上取得 78.08% 的 response-level F1,高于 SFT 基线的 66.37%。
来源:arXiv · Computation and Language · arxiv.org