热点事件持续更新
RPTune:学习式上下文策展优化 LLM 目录搜索
1 篇报道1 个报道来源2 小时前 更新
先了解这件事
AI 综述
2026-10-02 报道显示,RPTune 是一个端到端框架,将学习式目录策展与 LLM 后训练结合,利用自动生成的目录监督信号优化产品搜索。编码器-重组器策展器根据下游 LLM 反馈对商品排序和剪枝,策展后的目录再通过上下文相关奖励进一步提升后训练效果。在 7 个真实商户、每种 100 条复杂对话查询的评估中,策展带来最高 31.4 个百分点的准确率提升,后训练额外平均提升 10.3 个百分点,适用于闭源和开源 LLM。
AI 根据报道生成 · 1 小时前更新
最新进展10月2日 12:00
2026-10-02 arXiv 发布 RPTune 论文,报告其在真实商户场景中的准确率与后训练增益。报道时间线
沿着报道,了解事件的不同侧面。
10月2日
- arXiv · Information RetrievalRPTune:通过学习式上下文策展优化 LLM 目录搜索
RPTune 是一个端到端框架,将学习式目录策展与 LLM 后训练结合,利用自动生成的目录监督信号优化产品搜索。编码器-重组器策展器根据下游 LLM 反馈对商品排序和剪枝,策展后的目录再通过上下文相关奖励进一步提升后训练效果。在 7 个真实商户、每种 100 条复杂对话查询的评估中,策展带来最高 31.4 个百分点的准确率提升,后训练额外平均提升 10.3 个百分点,适用于闭源和开源 LLM。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。