arXiv · Information Retrieval· Omri Uzan, Ron Polonsky, Douwe Kiela, Christopher Potts·· 4 hr agoAI score40
DocOpt:用强化学习优化文档以改进黑盒检索
Document Optimization for Black-Box Retrieval via Reinforcement Learning
AI brief
提出 DocOpt,将文档改写建模为优化问题,用 GRPO 以检索排名提升为奖励训练 LLM 或 VLM 生成改写,仅需对检索器黑盒访问,适用于单向量、多向量和词法检索器。
Source: arXiv · Information Retrieval · arxiv.org