跳到正文
原文
arXiv · Machine Learning Theory· Mark Braverman, Jingyi Liu, Jieming Mao, Jon Schneider, Eric Xue·· 3 小时前AI 评分25

预算支出与学习的最佳节奏控制

Optimally Pacing Budget Spending and Learning

AI 导读

该研究在对抗设定下,针对任意预算节奏专家类给出了接近最优的遗憾界。对于 F 个专家和给定的候选预算节奏方案,所提全信息算法对累计支出与方案距离在 D 内的专家取得 O(D√log F + √(T log F)) 遗憾,匹配 Braverman et al. (2025) 的下界。

来源:arXiv · Machine Learning Theory · arxiv.org