NVIDIA détaille le déploiement de Qwen3.8-2.4T-A95B, modèle à 2,4T de paramètres, sur GB300 NVL72
Alibaba ouvre les poids de son plus grand modèle, un MoE à 2,4T de paramètres avec raisonnement configurable, servi sur l'infrastructure NVIDIA.
NVIDIA Developer Blog·Michelle Horton·12 août 2026

Image · Source originale
Alibaba a publié les poids ouverts de Qwen3.8-2.4T-A95B (Qwen3.8-Max), son plus grand modèle open-weight, avec 2,4T de paramètres totaux dont 95B activés par token. L'architecture repose sur un mixture of experts finement segmenté combinant attention complète et linéaire. NVIDIA présente son déploiement optimisé sur les systèmes GB300 NVL72.