Toutes les news taguées avec ce sujet.
Des chercheurs montrent qu'injecter un raisonnement malveillant mais anodin dans le contexte d'un LLM permet d'échapper aux moniteurs de sécurité chargés de détecter des actions dangereuses.