跳到正文
原文
arXiv · Artificial Intelligence· Shihab Ahmed, Debamita Ghosh, David Tang, Yudan Wang, Alvaro Velasquez, Yue Wang·· 3 小时前AI 评分40

Robust Nash Alignment under Preference Uncertainty

Robust Nash Alignment under Preference Uncertainty

AI 导读

summary_zh: 研究提出 Robust Nash Alignment,一种针对不确定成对偏好的博弈论对齐框架,主学习器在模糊集内同时对抗对抗性竞争者和任意偏好核寻求最差胜率最大的策略。

来源:arXiv · Artificial Intelligence · arxiv.org