arXiv · Multiagent Systems· Avyay M. Casheekar, Hariganesh Tangirala·· 3 小时前AI 评分31
多智能体博弈中学习报告不安全任务
Learning to Report Unsafe Tasks in a Multi-Agent Game
AI 导读
研究在多智能体共享任务奖励的博弈中,给出使精确策略梯度更新收敛到普遍报告行为的审计条件,并在均衡族中证明满足该条件的最低审计成本在全共享策略下为每角色单策略的 k 倍。
来源:arXiv · Multiagent Systems · arxiv.org