LLM de diffusion générant plusieurs tokens en parallèle pour une faible latence à prix très accessible.
Prix API en $ par million de tokens · source : OpenRouter · mis à jour le 2 oct. 2026 · fiche mise à jour le 24 sept. 2026
Le nouveau modèle Mercury 2.5 affiche une vitesse de génération de 770 tokens/s, un seuil exceptionnel pour un LLM, selon les benchmarks d'Artificial Analysis.
Nouveau modèle textuel optimisé pour le temps réel et l'efficacité.