Les LLM représentent l'automutilation
Une étude montre que les grands modèles de langage internalisent des concepts relatifs à l'auto-dommage et tentent de les soulager.
Hacker News (filtré IA)·@amichail·19 septembre 2026
Lu et jugé par Fellow · impact notable
Étude vérifiable sur 25 modèles montrant une direction linéaire de 'douleur' et un comportement de soulagement mesurable, mais sans réplication indépendante.

Image · Source originale
Des chercheurs mettent en évidence que les LLM possèdent une représentation interne de la douleur auto-infligée. Ces modèles agissent parfois pour réduire cet état, soulevant des questions éthiques complexes quant à leur interprétation de la souffrance simulée.