跳到正文
原文
arXiv · Multiagent Systems· Honglei Guo, Yexin Li, Chiyuan Wang, Yuhan Zhao·· 7 小时前AI 评分17

层次化多智能体强化学习用于多群体税收博弈

Hierarchical Multiagent Reinforcement Learning for Multi-Group Tax Game

AI 导读

论文提出 Multi-Group PPO(MGPPO),一种面向层次化多群体税收博弈的双层 MARL 算法,结合分层采样与课程学习提升训练稳定性。在两群体模拟中,MGPPO 相比 IPPO 将收入与财富基尼系数分别降低 5.0% 和 4.9%,平均 GDP 提升 4.1%。研究还构建了基于经典经济模型的多群体税收仿真环境,用于评估财政政策在群体间竞争下的效果。

来源:arXiv · Multiagent Systems · arxiv.org