[ICML2024] Modelagem de Recompensa para Aprendizado por Reforço com um Agente de Recompensa Assistente | Knoovi