Neste vídeo, mergulho em três artigos avançados que abordam o problema do cenário de recompensas esparsas no Aprendizado por Reforço Profundo e propõem direções de pesquisa interessantes para dominar o aprendizado não supervisionado em agentes autônomos.
Artigos discutidos:
Aprendizado por Reforço com Tarefas Auxiliares Não Supervisionadas - DeepMind:
Exploração Motivada pela Curiosidade - UC Berkeley:
Replay de Experiência Retroativa - OpenAI:
Se você quiser apoiar este canal, aqui está meu link do patreon: