arXiv · Machine Learning· Akash Kumar·· 7 小时前AI 评分42
表示学习能否与损失最小化解耦?Polar Updates 给出答案
Can Representation Learning Decouple from Loss Minimization? Polar Updates Have an Answer
AI 导读
summary_zh: 研究探讨表示学习是否在训练损失停止改善时就停止,以矩阵 Muon 为对象,其 polar-normalised updates 的步长由梯度秩而非梯度范数设定。
来源:arXiv · Machine Learning · arxiv.org