arXiv · Multiagent Systems· Brandon Gary Kaplowitz, Osaze James Obahor, Christian Schroeder de Witt·· 4 hr agoAI score25
MA-JEPA:面向多智能体强化学习的联合嵌入世界模型
MA-JEPA: Joint-Embedding World Models for Multi-Agent Reinforcement Learning
AI brief
MA-JEPA 是一种随机世界模型,用目标表示预测取代观测重建,支持集中训练、分散执行的多智能体强化学习。该模型采用类别潜状态与因果 Transformer,通过联合预测器预测各智能体的下一局部观测嵌入,并用于 actor-critic 潜空间想象训练。在 SMAC 基准上,其在 8 张评测地图中的 4 张达到或超过最强对比方法的平均胜率。
Source: arXiv · Multiagent Systems · arxiv.org