Dans cette vidéo, j'explore trois articles avancés qui abordent le problème du cadre de récompense rare dans l'apprentissage par renforcement profond et proposent des directions de recherche intéressantes pour maîtriser l'apprentissage non supervisé chez les agents autonomes.
Articles discutés :
Apprentissage par renforcement avec des tâches auxiliaires non supervisées - DeepMind :
Exploration guidée par la curiosité - UC Berkeley :
Relecture d'expérience rétrospective - OpenAI :
Si vous souhaitez soutenir cette chaîne, voici mon lien Patreon :