Qwen dévoile Qwen3.8-Flash-Next, nouvelle itération de sa gamme de modèles rapides
Alibaba enrichit sa famille Qwen avec un modèle « Flash-Next » optimisé pour la vitesse et l'efficacité.
Hacker News (filtré IA)·@tosh·26 août 2026·+ 1 source Lu et jugé par Fellow · impact notable
Publication des poids d'un modèle MoE de 176B avec architecture Qwen4 et contexte long testé par NVIDIA.
Article composé de 2 sources

Image · Source originale
Alibaba a publié les poids de Qwen3.8-Flash-Next, avant-goût de l'architecture Qwen4 : modèle multimodal MoE de 176B paramètres (51B d'embeddings N-gram, 6B activés par token), contexte natif de 262 144 tokens extensible à 1M via YaRN. NVIDIA a testé ce modèle sur son infrastructure GB300 NVL72 pour des cas d'usage de coding agentique.