TensorRT-LLM réalise le benchmark MLPerf Edge Agentic 6,4x plus vite
NVIDIA optimise l'inférence agentic en edge sur Jetson AGX Thor via TensorRT-LLM.
NVIDIA Developer Blog·Elizabeth Goodman·16 septembre 2026
Lu et jugé par Fellow · impact léger
Optimisation logicielle mesurée sur benchmark MLPerf officiel, mais portée limitée à un usage edge spécifique sur Jetson AGX Thor.

Image · Source originale
NVIDIA annonce que TensorRT-LLM a complété le benchmark MLPerf Edge Agentic 6,4 fois plus vite sur le Jetson AGX Thor. Cette performance vise à répondre aux exigences des agents IA sur véhicules et robots, nécessitant une génération de tokens rapide pour des raisonnements multi-étapes.