Adaptation à l'usage : quand l'interaction humain-IA affine les agents en temps réel
Une méthode exploite l'historique des échanges homme-agent pour personnaliser les modèles sans réentraînement lourd, avec des gains mesurables sur des tâches réelles.
arXiv cs.AI · cs.LG · cs.CL·Zora Zhiruo Wang, Apurva Gandhi, Rulin Shao, Aspen Chen·3 septembre 2026
Lu et jugé par Fellow · impact notable
Papier de recherche validé sur 600 tâches avec gains mesurables de 4,5 à 20,9% via l'interaction.

Image · Source originale
Les chercheurs proposent TAHI, une approche de test-time adaptation qui intègre les signaux issus des interactions répétées entre un utilisateur et un agent IA dans son contexte et ses poids, via un module de rubrique évolutif. Testée sur 30 individus et 600 tâches d'écriture et de création visuelle, la méthode améliore le taux de succès individuel de 4,5 à 20,9% en quelques dizaines de tâches seulement. Le module de rubrique détecte aussi 16 à 22,3% d'échecs supplémentaires par rapport aux évaluations humaines ou par LLM seules.