💡 Inscrivez-vous pour accéder au cours complet :
Bienvenue dans cette série sur l'apprentissage par renforcement ! Dans cette vidéo, nous allons approfondir notre réflexion sur les récompenses cumulées qu'un agent reçoit dans un processus de décision de Markov et introduire le concept important de retour.
Nous verrons que le retour est exactement ce qui pousse l'agent à prendre les décisions qu'il prend. Nous introduirons également l'idée d'épisodes et parlerons des tâches épisodiques par rapport aux tâches continues.
Sources :
Reinforcement Learning: An Introduction, Second Edition par Richard S. Sutton et Andrew G. Bartow
Jouer à Atari avec l'apprentissage par renforcement profond par Deep Mind Technologies
🕒🦎 SECTIONS DE LA VIDÉO 🦎🕒
00:00 Bienvenue chez DEEPLIZARD - Allez sur deeplizard.com pour des ressources d'apprentissage
00:30 Aidez deeplizard à ajouter des horodatages vidéo - Voir l'exemple dans la description
06:18 Intelligence collective et le DEEPLIZARD HIVEMIND
💥🦎 RESSOURCES DE LA COMMUNAUTÉ DE DEEPLIZARD 🦎💥
👋 Salut, nous sommes Chris et Mandy, les créateurs de deeplizard !
👉 Consultez le site pour plus de matériel d'apprentissage :
💻 INSCRIVEZ-VOUS POUR OBTENIR L'ACCÈS AUX FICHIERS DE CODE
🧠 Soutenez l'intelligence collective, rejoignez le hivemind de deeplizard :
🧠 Utilisez le code DEEPLIZARD lors de votre commande pour bénéficier de 15 % de réduction sur votre première commande Neurohacker
👉 Utilisez votre reçu de Neurohacker pour obtenir une réduction sur les cours deeplizard
👀 DÉCOUVREZ NOTRE VLOG :
❤️🦎 Remerciements spéciaux aux polymathes suivants du hivemind de deeplizard :
Tammy
Mano Prime
Ling Li
🚀 Boostez l'intelligence collective en partageant cette vidéo sur les réseaux sociaux !
👀 Suivez deeplizard :
🎓 Apprentissage profond avec deeplizard :
🎓 Autres cours :
🛒 Découvrez les produits recommandés par deeplizard sur Amazon :
🎵 deeplizard utilise de la musique de Kevin MacLeod
❤️ Veuillez utiliser les connaissances acquises grâce au contenu de deeplizard pour le bien, pas pour le mal.