Émergence d'une conscience introspective chez les grands modèles de langage
Une étude explore la capacité des LLM à détecter et rapporter des états internes injectés, signe d'une introspection émergente.
Hacker News (filtré IA)·@doener·11 août 2026

Image · Source originale
Des chercheurs testent si des LLM peuvent identifier des concepts ou activations artificiellement injectées dans leurs propres représentations internes. Les résultats montrent des capacités introspectives limitées mais mesurables, variant selon les modèles. Ces travaux interrogent les liens entre auto-rapport des modèles et leurs mécanismes internes réels.