Aqui cobrimos seis esquemas de otimização para redes neurais profundas: descida de gradiente estocástica (SGD), SGD com momentum, SGD com momentum de Nesterov, RMSprop, AdaGrad e Adam.
Capítulos
---------------
Introdução 00:00
Revisão rápida 00:27
Descida de gradiente estocástica (SGD) 03:16
SGD com momentum 05:01
SGD com momentum de Nesterov 07:02
AdaGrad 09:46
RMSprop 12:20
Adam 13:23
SGD vs Adam 15:03