OUTILS
Show HN : expériences minimalistes de post-training LLM sur GPU 8 Go (SFT, DPO, GRPO)
Un projet open source propose des scripts légers pour tester SFT, DPO et GRPO sur du matériel grand public limité à 8 Go de VRAM.
Hacker News (filtré IA)·@popopanda·1 août 2026

Image · Source originale
Ce projet GitHub fournit des expériences minimales de post-training de LLM exécutables sur un GPU de 8 Go seulement. Il couvre trois techniques courantes : le fine-tuning supervisé (SFT), le DPO et le GRPO. L'objectif est de rendre ces méthodes accessibles à des chercheurs ou hobbyistes sans infrastructure lourde.