Toutes les news taguées avec ce sujet.
Une nouvelle méthode Bayesian IRL qui infère une distribution de récompenses via l'apprentissage d'une distribution sur les Q-values.