En este video profundizo en tres artículos avanzados que abordan el problema del entorno de recompensas escasas en el Aprendizaje por Refuerzo Profundo y proponen direcciones de investigación interesantes para dominar el aprendizaje no supervisado en agentes autónomos.
Artículos discutidos:
Aprendizaje por Refuerzo con Tareas Auxiliares No Supervisadas - DeepMind:
Exploración Impulsada por la Curiosidad - UC Berkeley:
Repetición de Experiencias en Retrospectiva - OpenAI:
Si quieres apoyar este canal, aquí está mi enlace de patreon: