Les modèles sortis ces 4 derniers mois, dont la sortie a été confirmée par au moins deux sources du flux. Prix API en dollars par million de tokens, mis à jour chaque jour. Passé 120 jours, un modèle quitte le classement.
Journal des sorties →Comparer des modèles →Annuaire des outils →
| Modèle | Sortie | $ in | $ out | Commentaire |
|---|---|---|---|---|
| Gemini 4 Argon | 30 sept. 2026 | $2 | $10 | Nouvelle itération propriétaire de Gemini chez DeepMind, détails et benchmarks encore peu communiqués. |
| GPT-6.1 Sol | 30 sept. 2026 | $2 | $10 | Modèle propriétaire OpenAI proche de GPT-6 Astra en performances mais environ 5x moins cher à l'usage API. |
| Claude Sonnet 5.5 | 28 sept. 2026 | $2 | $10 | Succède à Sonnet 5 pour les tâches de code courantes, environ 2$/10$ par million de tokens en entrée/sortie. |
| Holo4 | 28 sept. 2026 | — | — | Modèle de H Company dédié aux agents autonomes qui naviguent et cliquent dans des interfaces graphiques. |
| Gemini 3.8 | 23 sept. 2026 | — | — | Modèle de synthèse vocale de Google DeepMind, destiné à générer une voix naturelle et expressive. |
| Claude Opus 5.5 | 22 sept. 2026 | $4 | $20 | Modèle phare d'Anthropic pour le raisonnement complexe et le code sur de grandes bases, dans un marché aux prix agressifs. |
| GPT-6 Sol and Luna | 22 sept. 2026 | $2 | $10 | Nouveaux modèles d'OpenAI évalués pour leurs benchmarks et leur rapport prix/performance face à la concurrence. |
| MiMo-V2.6-Pro | 22 sept. 2026 | $0.43 | $0.87 | Modèle open-weights omnimodal de Xiaomi, positionné en tête sur le rapport performance-coût. |
| Gemini 3.8 Live | 15 sept. 2026 | $0.75 | $4.50 | Modèle temps réel pour interactions vocales et multimodales, avec variante à raisonnement étendu. |
| Jev | 15 sept. 2026 | $0.04 | gratuit | Modèle fermé devenu viral en deux jours, générant une vague de clones communautaires (Laya, DiffusionGemmaJev). |
| SWE-2 | 10 sept. 2026 | — | — | Modèle fermé de Cognition spécialisé en génie logiciel terminal, positionné face à Fable 5.1 et GPT-Astra. |
| DeepSeek-V4.1 Flash | 9 sept. 2026 | $0.03 | $0.75 | LLM open-weight à mixture d'experts pensé pour faible latence, moins cher et plus performant que la version Pro précédente. |
| Mercury 2.5 | 9 sept. 2026 | $0.04 | $0.15 | LLM de diffusion générant plusieurs tokens en parallèle pour une faible latence à prix très accessible. |
| ChatGPT Images 2.5 | 8 sept. 2026 | $5 | $30 | Convertit esquisses, photos ou idées en images plus fidèles à l'intention de l'utilisateur. |
| GPT-6 Astra | 4 sept. 2026 | $10 | $50 | Modèle fermé haut de gamme d'OpenAI pour usage professionnel intensif : raisonnement, code, recherche approfondie et création de documents. |
| Astra | 3 sept. 2026 | $10 | $50 | Modèle non publié d'OpenAI visant l'automatisation de la recherche en IA, objectif interne fixé pour 2026. |
| Muse Spark 1.3 | 3 sept. 2026 | $1.25 | $4.25 | Modèle open-weights de Meta pour tâches agentiques longues, avec coût d'entraînement fortement réduit. |
| Gemini 3.8 Flash | 2 sept. 2026 | $0.75 | $3.75 | Flash le plus performant de Google, avec gains marqués en ingénierie logicielle et raisonnement multi-étapes. |
| Claude Fable 5.1 | 1 sept. 2026 | $10 | $50 | Modèle SOTA en agentic coding et contexte long, mais coût par tâche en hausse malgré la baisse du cache de lecture. |
| Gemini Omni 1.1 Flash | 27 août 2026 | $1.50 | $17.50 | Mise à jour du modèle multimodal léger de Google, avec plus de rapidité et de contrôle pour les développeurs. |
| Gemini-3.5-Transcribe | 26 août 2026 | — | — | Modèle de transcription audio vers texte dérivé de Gemini, spécialisé dans les accents, le bruit et le multilingue. |
| GLM-5.3 Flash | 26 août 2026 | $0.15 | $0.50 | Modèle multimodal à poids ouverts et coût très réduit, pensé pour le codage efficace et les tâches agentiques longues avec attention hybride. |
| Qwen3.8-Flash-Next | 26 août 2026 | $0.15 | $0.47 | MoE ouvert de 176B (6B actifs) à contexte étendu jusqu'à 1M tokens, testé pour le coding agentique. |
| DeepSeek-V4-Flash-Vision-Exp | 21 août 2026 | $0.22 | $0.65 | Version expérimentale à poids ouverts et prix très bas, ajoutant la compréhension d'image à DeepSeek V4 Flash sans perdre ses capacités texte. |
| LFM2.5-DSpark | 20 août 2026 | — | — | Variante à poids fermés axée sur l'efficacité et le déploiement local, du datacenter au MacBook. |
| LFM2.5-DSSpark | 20 août 2026 | — | — | Version optimisée offrant une inférence bien plus rapide, du GPU H100 aux Mac Apple Silicon. |
| Qwen 3.8 27B | 16 août 2026 | $0.42 | $3 | Modèle ouvert vision-langage démontrant une bonne efficacité sur des tâches de reverse-engineering technique. |
| GLM-5.3 | 14 août 2026 | $1.40 | $4.40 | Modèle chinois open-weights orienté coding frontier et tâches agentiques longues, rivalisant avec les leaders US. |
| Qwen3.8 27B | 14 août 2026 | $0.42 | $3 | Modèle vision Apache 2.0 pour code et raisonnement, mais son mode 'xhigh' sur-raisonne sur matériel grand public. |
| Gemini 3.7 Flash | 13 août 2026 | $0.75 | $3.75 | Version allégée de Gemini pour réponses rapides et économiques, avec génération audio native intégrée. |
| LittleLearner | 13 août 2026 | — | — | Modèle de 5B entraîné sur un corpus scolaire restreint pour étudier l'acquisition de compétences sans contamination. |
| DeepSeek V4 Pro 0813 | 12 août 2026 | $0.66 | $1.98 | MoE à grande échelle orienté raisonnement et code, disponible en poids ouverts via API et Hugging Face. |
| Grok 4.6 | 12 août 2026 | $2 | $6 | Modèle fermé de xAI orienté agents longue durée, performant en code et travail de connaissance. |
| Qwen3.8-2.4T | 12 août 2026 | $2 | $6 | Modèle dense ouvert d'Alibaba à 2,4 trillions de paramètres, sans architecture MoE. |
| Nemotron 3.5 Lightning | 11 août 2026 | $0.06 | $0.16 | MoE léger (30B/3B actifs) taillé pour agents persistants à faible coût et latence sur RTX/DGX. |
| Muse Glimmer | 10 août 2026 | — | — | Modèle open-weights de 30B de paramètres conçu pour l'IA agentique locale, optimisé pour GPU NVIDIA. |
| DeepSeek V4 Flash 0731 | 7 août 2026 | $0.01 | $1.28 | Modèle ouvert à faible coût, mixture-of-experts adapté au code, au raisonnement et aux agents. |
| GPT-5.6 Luna | 5 août 2026 | $0.20 | $1.20 | Modèle fermé rapide et économique d'OpenAI, adapté au chat et aux workflows agentiques légers à fort volume. |
| LFM2.5 2.6B | 4 août 2026 | — | — | Modèle ouvert compact de LiquidAI pensé pour des agents locaux sur terminal. |
| Shieldstral | 4 août 2026 | — | — | Modèle ouvert de Mistral pour filtrer les prompts dangereux et limiter les risques de jailbreak. |
| Inkling-Small | 30 juil. 2026 | $0.45 | $1.20 | Version compacte et efficace en mixture-of-experts (12B actifs/276B) de Thinking Machines, poids ouverts. |
| Nemotron 3 Ultra | 27 juil. 2026 | $0.50 | $2.20 | Modèle ouvert de NVIDIA orienté agents, en tête sur la génération et vérification de code RTL pour puces. |
| Claude Opus 5 | 24 juil. 2026 | $5 | $25 | Modèle fermé haut de gamme d'Anthropic pour raisonnement complexe, code et tâches agentiques longues. |
| FLUX 3 | 23 juil. 2026 | — | — | Suite multimodale fermée de Black Forest Labs couvrant vidéo et robotique via Flow Matching. |
| Gemini 3.6 Flash | 21 juil. 2026 | $0.75 | $3.75 | Modèle fermé de Google orienté coût et latence pour le code et les workflows agentiques. |
| Laguna S 2.1 | 21 juil. 2026 | $0.09 | $0.18 | Modèle de code ouvert et économique de Poolside, conçu pour rivaliser avec des modèles bien plus gros. |
| Qwen 3.8 Max | 21 juil. 2026 | — | — | Modèle ouvert massif de 2,4T de paramètres, sortie majeure dans un contexte de tensions sur les modèles chinois. |
| Cosmos 3 Edge | 20 juil. 2026 | — | — | Déclinaison fermée de NVIDIA pensée pour l'IA embarquée, robotique et véhicules autonomes. |
| Kimi K3 | 17 juil. 2026 | $2.70 | $13.50 | Modèle chinois à poids ouverts de 2,8T paramètres, taillé pour code complexe et agents long terme, mais dont le battage dépasse peut-être les capacités. |
| Inkling | 15 juil. 2026 | $0.95 | $4.05 | Premier modèle open-weights de Thinking Machines, mixture-of-experts à 975 milliards de paramètres pour usages généraux. |
| GPT-Live | 8 juil. 2026 | — | — | Modèle vocal fermé propulsant ChatGPT Voice pour des conversations plus fluides avec l'IA. |
| Grok 4.5 | 8 juil. 2026 | $2 | $6 | Modèle fermé de xAI centré code et agents, rapide et économe, intégré à Cursor et à l'API xAI. |
| Robostral Navigate | 8 juil. 2026 | — | — | Modèle Mistral fermé dédié à la navigation et perception robotique pour agents physiques autonomes. |
| GPT-5.6 Sol Ultra | 6 juil. 2026 | $5 | $30 | Version renforcée de GPT-5.6 pressentie pour intégrer l'agent de code Codex, selon des informations non confirmées officiellement. |
| Leanstral 1.5 | 1 juil. 2026 | gratuit | gratuit | Modèle Mistral léger et gratuit dédié à la vérification formelle de preuves en Lean, pensé pour des déploiements à ressources limitées. |
| GPT-5.6 | 27 juin 2026 | $5 | $30 | Modèle propriétaire d'OpenAI dont l'accès sera soumis à une validation par le gouvernement américain. |
| GPT 5.6 Sol | 26 juin 2026 | $2 | $10 | Modèle phare de la série 5.6 orienté raisonnement, code en ligne de commande et cybersécurité, avec une stack de sécurité renforcée. |
| Ornith-1.0 | 25 juin 2026 | — | — | Famille de modèles ouverts spécialisée dans le codage agentique multi-étapes autonome. |
| Mistral OCR 4 | 23 juin 2026 | — | — | Nouvelle version du moteur d'OCR de Mistral pour l'extraction de texte à partir de documents. |
| GLM 5.2 | 13 juin 2026sort dans 9 j | $0.41 | $3.99 | Modèle open-weights sous licence MIT, référence en coding frontend et en tête des modèles ouverts sur les benchmarks. |
| Kimi-K2.7-Code | 12 juin 2026sort dans 8 j | $0.67 | $3.35 | Modèle open weights spécialisé code, pensé pour des tâches de programmation complètes sur de longs contextes. |
| Fable | 11 juin 2026sort dans 7 j | — | — | Modèle fermé d'Anthropic dont l'usage précis n'est pas détaillé dans les sources disponibles. |
| DiffusionGemma | 10 juin 2026sort dans 6 j | — | — | Variante fermée de Gemma utilisant la diffusion discrète pour une génération de texte plus rapide. |
| Claude Fable 5 | 9 juin 2026sort dans 5 j | $10 | $50 | Modèle Mythos-class à contexte 1M tokens pour le travail de connaissance et le code, avec rétention de données désormais obligatoire. |
Open source : poids téléchargeables · —prix non publié (pas d'API ou pas encore trouvé) · $ par million de tokens, entrée / sortie.