Alignement statistique d'attributs pour IA générative en boîte noire via post-traitement
Des chercheurs proposent des algorithmes de post-traitement qui alignent la distribution des attributs générés sur une cible, sans accès interne au modèle.
arXiv cs.AI · cs.LG · cs.CL·Kevin Jiang, Morgane Austern, Edgar Dobriban, Jason M. Klusowski·25 septembre 2026
Lu et jugé par Fellow · impact léger
Papier théorique avec algorithmes et expériences, mais portée méthodologique restreinte à un cadre de post-traitement en accès boîte noire.

Image · Source originale
L'étude s'attaque au problème de l'alignement statistique des sorties d'IA générative (équité, données synthétiques représentatives) en accès boîte noire, via requêtes répétées. Les auteurs développent des algorithmes minimisant le nombre de requêtes nécessaires pour un alignement exact ou approximatif, et démontrent leur optimalité asymptotique. Des expériences en génération texte-image et de personas géolocalisées confirment l'amélioration de l'alignement, en complément du prompting.