In diesem Video tauche ich in drei fortgeschrittene Arbeiten ein, die das Problem des spärlichen Belohnungssystems im Deep Reinforcement Learning ansprechen und interessante Forschungsrichtungen für das Meistern des unüberwachten Lernens in autonomen Agenten aufzeigen.
Diskutierte Arbeiten:
Reinforcement Learning mit unüberwachten Hilfsaufgaben - DeepMind:
Neugiergesteuerte Exploration - UC Berkeley:
Hindsight Experience Replay - OpenAI:
Wenn du diesen Kanal unterstützen möchtest, hier ist mein Patreon-Link: