梯度下降与优化器实战:SGD、Momentum、Adam 的原理与选择
梯度下降与深度学习优化器实战:梯度下降的直觉与收敛、学习率的角色、SGD 与批大小、Momentum 指数加权、AdaGrad/RMSProp 自适应、Adam 与 AdamW、学习率调度、优化器选择矩阵、优化器的工程实践与调试。
tag
梯度下降与深度学习优化器实战:梯度下降的直觉与收敛、学习率的角色、SGD 与批大小、Momentum 指数加权、AdaGrad/RMSProp 自适应、Adam 与 AdamW、学习率调度、优化器选择矩阵、优化器的工程实践与调试。