Toutes les news taguées avec ce sujet.
Une méthode d'échantillonnage par importance permet d'estimer des probabilités d'événements catastrophiques rares chez les agents IA, jusqu'à 800× plus efficace que le Monte Carlo naïf.
Une correction additive corrige le biais de dérive entre moteurs d'entraînement et d'inférence, source d'instabilité du RL sur les LLM.