Toutes les news taguées avec ce sujet.
Selon le dirigeant d'Arm, le manque de semiconducteurs retarde les avancées médicales basées sur l'IA.
Deux accélérateurs MI350P refroidis par liquide et un Threadripper 96 cœurs : AMD promet de faire tourner des modèles à mille milliards de paramètres.
Analyse des capacités actuelles de l'IA pour la conception de PCB et des défis techniques restants.
L'infrastructure d'inférence nécessite une optimisation globale mémoire, stockage et réseau pour réduire latence et coûts.
Un développeur détaille son usage de Claude pour reconstruire l'émulation d'un ancien lecteur de bande QIC-117, entre rétro-ingénierie et assistance IA.
Annuaire technique et comparatif des processeurs graphiques pour l'IA et le gaming.
Le constructeur de Cupertino s'impose comme un acteur de l'infra IA grâce à cet achat massif.
Une demande inattendue pour les capacités IA pousse Apple à accélérer la production de ses Mac Mini et Studio.
Une main anthropomorphe à câbles optimisée pour l'apprentissage par renforcement en simulation.
Le constructeur développe un écosystème logiciel complet pour sécuriser sa suprématie face à la concurrence.
Analyse technique des défauts des GPU Nvidia pour l'inférence et présentation de l'architecture du processeur OpenAI Jalapeño.
Une proposition de standard visant à uniformiser les interactions entre modèles d'IA et matériel informatique.
Un nouveau robot mobile abordable et modulaire pour la recherche et le hacking.
OpenAI dévoile son puce inference Jalapeño, surpassant NVIDIA en efficacité énergétique lors de la conférence Hot Chips.
Le déploiement de modèles sur poste personnel demande une rigueur technique et une gestion fine des ressources matérielles.
Un nouvel ordinateur portable embarque un agent IA fonctionnant entièrement en local, promettant de s'affranchir des frais liés aux API cloud.
Analyse de la répartition des risques de crédit dans la plateforme de financement de 500 milliards de dollars mise en place par Nvidia.
OpenAI présente les performances de Jalapeño, sa puce maison, avec des gains annoncés en vitesse et en efficacité énergétique pour l'inférence.
Nouvelle génération de puces Apple Silicon promettant des gains significatifs pour les charges de travail IA et le calcul intensif.
Présentation d'une version hardware légère de LPU capable d'exécuter l'inférence de MicroGPT.
Xiaomi dévoile un appareil dédié à l'IA locale capable de faire tourner un modèle de 120 milliards de paramètres à 330 tokens/s.
Une nouvelle puce présentée comme offrant une vitesse d'inférence de pointe pour les workloads d'agents IA entre en production à grande échelle.
NVIDIA dévoile le processeur Groq 3 LPX pour l'accélération de l'inférence interactive sur la plateforme Vera Rubin NVL72.
Vue d'approfondissement sur les conceptions matérielles optimisées pour l'entraînement et l'inférence.
Mythic propose une puce analogique compute-in-memory pour réduire la consommation énergétique de l'inférence.
Analyse technique des mécanismes internes et des implications de l'accès mémoire sur les unités de traitement graphique.
Un passionné détaille son installation multi-GPU maison pour faire tourner et entraîner des modèles d'IA en local.
Une analyse vidéo des performances des processeurs Cerebras face aux dominantes solutions graphiques de Nvidia.
Le fabricant de puces spécialisées annonce la prochaine génération de son système de calcul dédié à l'IA à grande échelle.
La société connue pour ses systèmes de conduite assistée lance un dock eGPU à firmware ouvert, vendu nu à 249 $ ou avec une RX 9060 à 799 $.