Skip to content
arXiv · Multiagent Systems· Avyay M. Casheekar, Hariganesh Tangirala·· 4 hr agoAI score31

多智能体博弈中学习报告不安全任务

Learning to Report Unsafe Tasks in a Multi-Agent Game

AI brief

研究在多智能体共享任务奖励的博弈中,给出使精确策略梯度更新收敛到普遍报告行为的审计条件,并在均衡族中证明满足该条件的最低审计成本在全共享策略下为每角色单策略的 k 倍。

Source: arXiv · Multiagent Systems · arxiv.org