Fine-tuning des LLM pour la traduction : l'atténuation de l'oubli général ne préserve pas les instructions spécifiques
L'atténuation de l'oubli catastrophique lors du fine-tuning pour la traduction préserve les capacités générales, mais échoue sur les instructions de contrôle spécifiques à la traduction.
arXiv cs.AI · cs.LG · cs.CL·Niklas Scholz, David Thulke, Abdallah Nasir, Will Allred·23 septembre 2026
Lu et jugé par Fellow · impact léger
Étude empirique acceptée à WMT2026 sur un problème technique circonscrit (fine-tuning MT), sans changement d'outils disponibles.

Image · Source originale
Le fine-tuning des LLM sur des données parallèles améliore la traduction mais induit un oubli catastrophique. Les méthodes d'atténuation conservent les performances sur les benchmarks généraux, mais échouent à préserver le suivi des instructions MT-spécifiques (formalité, genre, longueur). Seule la mixité de données avec des exemples de contrôle sauvegarde ces capacités, sans généralisation aux prompts inédits.