arXiv · Machine Learning Theory· Qijia He, Yu Huang, Yuan Cheng, Yuxin Chen, Yingbin Liang·· 3 小时前AI 评分31
Beam Search 在 LLM 推理中的可证明测试时扩展性
Provable Test-Time Scaling for Beam Search in LLM Reasoning
AI 导读
论文为 LLM 推理中的 beam search 建立了测试时计算下界,证明最优响应存活至少需要 Ω(C⋆(x)²) 个样本。提出的 CF-Beam 将前缀竞争场景下的覆盖依赖从二次降至近线性,且遗憾值由稀有失败概率和路径级覆盖系数决定。实验显示 beam search 在困难实例和更长推理窗口下比 Best-of-N 等序列级方法更稳健。
来源:arXiv · Machine Learning Theory · arxiv.org