[ICML2024] Modelage de récompense pour l'apprentissage par renforcement avec un agent de récompense assistant | Knoovi