Toutes les news taguées avec ce sujet.
Une nouvelle plateforme interactive pour explorer les modèles Gemma et construire des agents.
Inférence d'un modèle 26B sur du matériel obsolète via optimisation logicielle.
Un dépôt Hugging Face laconique évoque un modèle de 12 milliards de paramètres basé sur l'architecture Gemma, sans détails officiels.
Le modèle Gemma 4 de Google tourne désormais en inférence ultra-rapide via Cerebras pour alimenter des applications vocales en temps réel.
Cerebras annonce le support de Gemma 4 sur son infrastructure, combinant sa vitesse d'inférence record avec les capacités multimodales du modèle de Google.