跳到正文
原文
arXiv · Statistics Machine Learning· Stephen Y Zhang, Gabriel Peyr\'e·· 3 小时前AI 评分23

两层线性网络训练的全局指数收敛性

Global Exponential Convergence of Two-Layer Linear Network Training

AI 导读

该研究证明,在 rich scaling 下以光滑 Polyak-Lojasiewicz 预测器损失训练的宽两层线性网络具有带显式速率的全局指数(线性)收敛性。

来源:arXiv · Statistics Machine Learning · arxiv.org