RECHERCHE
Les LLM réutilisent la syntaxe humaine plus que les humains
Une étude sur Llama et Gemma montre que l'instruction-tuning renforce la réutilisation de règles syntaxiques humaines, dépassant les taux observés entre humains.
arXiv cs.AI · cs.LG · cs.CL·Zandi Eberstadt·28 juillet 2026

Image · Source originale
Des chercheurs ont analysé la convergence syntaxique de seize modèles Llama et Gemma, couvrant de 1 à 70 milliards de paramètres. En remplaçant les tours de parole dans des dialogues humains, l'étude révèle que chaque modèle réutilise davantage les règles de grammaire du tour précédent qu'un humain ne le ferait. Ce phénomène s'intensifie avec l'instruction-tuning, bien que les modèles finement réglés montrent aussi plus de similarité avec des phrases aléatoires.