Toutes les news taguées avec ce sujet.
Un nouveau runtime accélère le RL post-training des VLM en chevauchant traitement de préfixe et décodage de rollout sur GPU.