LFM2.5-DSpark : jusqu'à 3,2x d'inférence plus rapide, du H100 au MacBook
Liquid AI dévoile LFM2.5-DSpark, une nouvelle version de son modèle optimisée pour accélérer l'inférence sur une large gamme de matériel.
Hacker News (filtré IA)·@Alephinitesimal·21 août 2026
Lu et jugé par Fellow · impact majeur
Release publique de modèles de décodage spéculatif (DSpark) pour LFM2.5, disponibles sur Hugging Face et intégrés à llama.cpp et SGLang.

Image · Source originale
Liquid AI annonce LFM2.5-DSpark, une variante de son modèle promettant des gains de vitesse d'inférence allant jusqu'à 3,2x, aussi bien sur GPU H100 en datacenter que sur MacBook. L'accent est mis sur l'efficacité et le déploiement local.