MoE léger (30B/3B actifs) taillé pour agents persistants à faible coût et latence sur RTX/DGX.
Prix API en $ par million de tokens · source : OpenRouter · mis à jour le 2 oct. 2026 · fiche mise à jour le 12 août 2026
NVIDIA dévoile Nemotron 3.5 Lightning, un modèle open-weights optimisé pour l'exécution rapide des tâches des agents IA.