arXiv · Multiagent Systems· Amit Thakur, Mukesh Singhal·· 16 小时前AI 评分26
多智能体 Transformer 策略中的动作坍缩问题研究
Permutation Robustness Is Not Enough: Action Collapse in Multi-Agent Transformer Policies
AI 导读
研究指出 Transformer 策略在多智能体机器人学习中虽有优势,但智能体无序性与 Transformer 按序处理 token 的方式存在错配。研究发现低置换误差可能具误导性:策略看似稳健,实则可能因所有智能体选择同一动作而出现动作坍缩,需结合动作多样性、同动作比例和最大动作频率等诊断指标评估。
来源:arXiv · Multiagent Systems · arxiv.org