Aquí cubrimos seis esquemas de optimización para redes neuronales profundas: descenso de gradiente estocástico (SGD), SGD con momentum, SGD con momentum de Nesterov, RMSprop, AdaGrad y Adam.
Capítulos
---------------
Introducción 00:00
Breve repaso 00:27
Descenso de gradiente estocástico (SGD) 03:16
SGD con momentum 05:01
SGD con momentum de Nesterov 07:02
AdaGrad 09:46
RMSprop 12:20
Adam 13:23
SGD vs Adam 15:03