跳到正文
原文
arXiv · Multiagent Systems· Shuang Guo, Xiaobo Sui, Fei Jiang, Ruixin Li, Manxiang Li, Rong Li, Ziyang Ou·· 3 小时前AI 评分45

SkillApt:面向技能增强型智能体的策略级 RSI 研究

Towards Strategy-Level RSI for Skill-Augmented Agents: Learning When to Reuse Skills from Execution Feedback

AI 导读

论文提出 SkillApt,用同一任务状态下 WITH/WITHOUT Skill 的配对执行作为持久证据,估计 Skill 的条件边际效用并决定 LOAD 或 ABSTAIN,基座模型、智能体架构与 Skill 内容保持不变,仅改变外部部署策略,称为策略级递归自我改进(Strategy-Level RSI)。

来源:arXiv · Multiagent Systems · arxiv.org