跳到正文
原文
arXiv · Multiagent Systems· Oana Madalina Fron, Ojas Shirekar, Chirag Raman·· 3 小时前AI 评分37

OverForge:通过策略与战术分离的推理实现合作性终身适应

OverForge: Reasoning Through Strategies and Tactics Helps Cooperative Lifelong Adaptation

AI 导读

OverForge 提出一种无需训练的分层架构,将战略推理(角色与劳动分工)与战术推理(个体动作)分离,并通过前额叶皮层模块进行策略-动作分支的前向预测与提交。在 OvercookedV2 中实现 7 道汤产出(基线为 3 道),能保留已有角色并采纳陌生伙伴提出的角色。跨 episode 的伙伴知识支持任务表现与伙伴预测,体现持续适应能力。

来源:arXiv · Multiagent Systems · arxiv.org