OUTILS
GPT 5.6 : coûts divisés par 13 via auto-optimisation
OpenAI révèle que GPT 5.6 a réduit ses propres coûts d'infrastructure grâce à l'optimisation autonome de kernels et speculative decoding.
Latent Space (Swyx)·31 juillet 2026

Image · Source originale
OpenAI annonce une baisse des coûts de 20 à 80 % pour GPT 5.6. Cette réduction est attribuée à l'auto-optimisation du modèle via l'écriture autonome de kernels Triton/Gluon (-20 % coût), le speculative decoding (+15 % efficacité) et l'optimisation du KV caching.