Toutes les news taguées avec ce sujet.
Hugging Face montre comment améliorer les sorties structurées d'un petit modèle via GRPO avec TRL, en seulement 100 étapes d'entraînement.
Un développeur présente un petit modèle capable de fonctionner directement sur mobile, sans infrastructure cloud lourde.
Un développeur détaille son approche pour concevoir un petit modèle de langage optimisé pour l'exécution CPU, sans GPU.
Le modèle LFM2.5 2.6B de LiquidAI offre des performances compétitives malgré sa taille réduite.