Distillation LLM et test-time training pour le recommandeur trade-up
Une méthode distille le raisonnement d'LLMs dans un classifieur léger avec adaptation locale par type de produit.
arXiv cs.AI · cs.LG · cs.CL·Siliang Liu, Mohammad Ghasemi, Sapan Patel, Amin Banitalebi-Dehkordi·4 septembre 2026
Lu et jugé par Fellow · impact léger
Papier workshop sur un cas d'usage e-commerce précis, gains mesurés mais application industrielle étroite et non déployée publiquement.

Image · Source originale
Ce papier propose un framework en deux niveaux pour la recommandation trade-up. Il distille d'abord le raisonnement d'un LLM dans un classifieur compact, puis adapte localement ses décisions via un test-time training spécifique aux catégories de produits.