[ICML2024] Belohnungsformung für Reinforcement Learning mit einem Assistenz-Belohnungsagenten | Knoovi