Toutes les news taguées avec ce sujet.
Une base publique recense les consignes données aux modèles d'IA pour comprendre leur comportement.
Des chercheurs montrent que des signaux discrets dans un prompt, combinés, orientent puissamment les réponses des modèles — y compris les modèles de raisonnement les plus avancés.
Soupçonnant l'utilisation d'IA par la cour, un plaideur intègre des instructions cachées pour orienter la décision.
Une méthode permet d'extraire le raisonnement interne de modèles fermés en interrogeant leurs APIs publiques.