Toutes les news taguées avec ce sujet.
OpenRouter intègre le modèle GPT-6 Astra, élargissant son catalogue de LLM.
Le modèle de transcription de Microsoft surpasse ses rivaux en coût et en rapidité.
Une méthode en quatre étapes pour vérifier l'identité de modèles anonymes via API, de la configuration aux sondages comportementaux.
Une documentation technique référençant les outils et skills disponibles sur ChatGPT pour les développeurs.
Le CMS open source Wagtail choisit d'intégrer l'IA comme fonctionnalité plutôt que de repenser son produit autour d'elle.
Un développeur publie un outil open source pour diagnostiquer la consommation rapide des quotas d'API Claude.
DeepMind met à jour son modèle multimodal Flash avec de nouvelles options de personnalisation pour les développeurs.
Indisponibilité généralisée des services et de l'API d'Anthropic, impactant l'accès à Claude.
OpenAI réduit sensiblement le tarif d'accès à son modèle phare pour développeurs, dans un contexte de concurrence tarifaire accrue sur les API LLM.
OpenAI annonce une baisse tarifaire de 20 % pour son modèle GPT 5.6 Sol.
DeepSeek publie une API pour un nouveau modèle multimodal, DeepSeek-V4-Flash-Vision-Exp, optimisé pour la vitesse.
OpenAI confirme l'option Zero Data Retention pour les clients API éligibles et présente le Private Safety Processing, pensé pour concilier sécurité IA et confidentialité des données.
Incident affectant la disponibilité et la réactivité des services d'Anthropic.
Cette plateforme unifiée permet aux développeurs d'accéder à divers modèles de synthèse vocale via une API unique.
Le laboratoire chinois introduit une tarification différenciée selon les horaires d'utilisation de son API.
Le fournisseur chinois ajuste ses prix à la baisse, renforçant sa compétitivité sur le marché des LLM.
L'augmentation tarifaire spectaculaire de l'API DeepSeek est désormais effective, impactant les coûts pour les développeurs.
Le nouveau tier API Ultrafast propulse GPT-5.6 Sol à une vitesse 14 fois supérieure via l'infrastructure Cerebras.
OpenAI dévoile comment tirer parti de GPT-5.6 pour des agents plus performants et économiques via la nouvelle Responses API.
Disponible sur OpenRouter, ce nouveau LLM vise à améliorer les performances en raisonnement et en génération de code.
Une méthode permet d'extraire le raisonnement interne de modèles fermés en interrogeant leurs APIs publiques.
Le fournisseur cloud allemand propose une plateforme expérimentale pour exécuter des modèles LLM.