揭示尺度不变优化中学习率与权重衰减的精确离散时间交互律,界定稳定性边界。
| scale-invariant optimization | 尺度不变优化,指在参数缩放下损失函数不变的优化问题,常见于归一化网络。 |
| weight decay | 权重衰减,一种正则化技术,通过在更新中减去参数的一部分来抑制过拟合。 |
| self-quenching effect | 自淬灭效应,指参数范数增长导致有效学习率自动减小的现象。 |
| discrete-time Jacobian | 离散时间雅可比矩阵,描述离散映射在平衡点附近的线性化行为,用于稳定性分析。 |
| homogeneous-optimizer framework | 齐次优化器框架,一种统一描述不同优化器(如SGD、Adam)在齐次模型下行为的理论框架。 |
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅