arXiv · Computation and Language· Tianzhu Zhang·· 5 小时前精选AI 评分60
大语言模型何时应信任自身修正:风险感知的内在自修正研究
When Should LLMs Trust Their Own Revisions? A Risk-Aware Study of Intrinsic Self-Correction
AI 导读
论文研究大语言模型内在自修正在 BoolQ、GSM8K 和 Corr2Cause 上的修正行为,发现二次推理既可纠正错误,也可能把初始正确答案翻错,例如 Llama-3.1-8B 在 GSM8K 提升 25.5 个百分点但改变 19.1% 的初始正确答案。
推荐理由
研究揭示自修正可能把正确答案翻成错误答案,读者可据此评估何时值得启用二次推理。
来源:arXiv · Computation and Language · arxiv.org