Safe Meta-RL via l'accessibilité dans l'espace d'information
Un nouveau cadre de meta-reinforcement learning garantissant la sécurité lors de l'adaptation à de nouvelles tâches.
arXiv cs.AI · cs.LG · cs.CL·Zeyang Li, Sunbochen Tang, Navid Azizan·14 septembre 2026
Lu et jugé par Fellow · impact léger
Papier de recherche théorique validée sur benchmarks, sans implémentation ou produit industriel diffusé.

Image · Source originale
Ce papier introduit un cadre de meta-reinforcement learning intégrant explicitement des contraintes de sécurité lors de l'adaptation. Les auteurs proposent de raisonner sur la sécurité dans un espace d'information combinant état physique et croyance de l'agent, via une fonction de valeur apprenable. Cette approche permet un filtrage de sécurité et une optimisation de politique sous contraintes, validée sur des benchmarks.