Ces tests d'intelligence piègent encore les IA
Les casse-têtes révèlent les forces et faiblesses cognitives des modèles par rapport à l'humain.
MIT Technology Review · IA·Grace Huckins·26 août 2026
Lu et jugé par Fellow · impact léger
Article de vulgarisation illustrant les limites cognitives des LLM via des puzzles, sans publication scientifique ni nouveau benchmark.

Image · Source originale
Les puzzles et jeux servent de benchmarks historiques pour évaluer l'IA. Si les modèles progressent rapidement, ils échouent encore sur des variations subtiles d'énigmes ou le visuel. Ces tests mettent en lumière les différences fondamentales entre cognition humaine et machine.