跳到正文
原文
arXiv · Multiagent Systems· Angel Y. He, David Parker·· 4 小时前AI 评分21

一般和并发随机博弈的稳健 PAC 学习

Robust PAC Learning of Concurrent Stochastic Games

AI 导读

论文提出首个面向含转移不确定性的一般和并发随机博弈(CSGs)的 PAC 学习框架,在处理 Nash 均衡存在性难题的同时,用数据驱动的 L¹ 置信集与稳健 MDP 探索机制计算社会福利最优的 ε-Nash 均衡。

来源:arXiv · Multiagent Systems · arxiv.org