Qwen 3.8-Flash-Next : sortie prévue demain (125B, 6B actifs)
Alibaba s'apprêterait à lancer un nouveau modèle MoE léger de la famille Qwen, avec seulement 6 milliards de paramètres actifs.
Hacker News (filtré IA)·@garo-pro·25 août 2026·+ 1 source Lu et jugé par Fellow · impact notable
Modèle MoE substantiel (125B) disponible en preview avec specs techniques vérifiables et tests par tiers.
Article composé de 2 sources

Image · Source originale
Alibaba a publié Qwen 3.8-Flash-Next, un MoE multimodal de 125B (51B embeddings N-gram) avec 6B actifs/token. Contexte natif de 262K tokens, extensible à 1M. NVIDIA teste ce modèle preview sur GB300 NVL72 pour le coding agentique.