NVIDIA Groq 3 LPX : ultra-rapidité et long contexte sur Vera Rubin
NVIDIA dévoile le processeur Groq 3 LPX pour l'accélération de l'inférence interactive sur la plateforme Vera Rubin NVL72.
NVIDIA Developer Blog·Tanya Lenz·24 août 2026
Lu et jugé par Fellow · impact majeur
Performance mesurée et vérifiée par un tiers (Artificial Analysis) à 3 431 tokens/s sur 100K de contexte.
Pourquoi ce titre est à nuancer
Le titre affirme une capacité 'ultra-rapide', mais le corps confirme cette performance par un benchmark précis de 3 431 tokens/s.

Image · Source originale
NVIDIA présente le Groq 3 LPX, un accélérateur d'inférence IA conçu pour la plateforme Vera Rubin NVL72. Cette combinaison vise à délivrer un débit élevé et une interactivité ultra-rapide pour une large gamme de workloads, des petits aux grands modèles, en supportant les contextes longs.