Toutes les news taguées avec ce sujet.
Analyse des spéculations sur une possible intentionnalité derrière la rareté des composants.
Le support de l'architecture Monarch sur ROCm optimise le single-controller distributed training.
Un partenariat pour une inférence ultra-rapide à haut débit.
AMD dévoile l'Epyc 9996 'Venice' avec 256 cœurs et une architecture Zen 6, promettant des gains significatifs face à Intel et NVIDIA.
Framework ajoute une option haut de gamme à son mini-PC Desktop, pensée pour l'inférence de modèles locaux volumineux.
Un développeur teste le mini-PC IA DGX Spark de Nvidia comme poste de travail quotidien, entre promesses et limites concrètes.
Un outil en ligne permet d'évaluer, selon les specs de sa machine, quels modèles d'IA locaux sont exécutables sans souci.
Yubico met à jour ses clés de sécurité pour étendre la gestion d'identité aux cas d'usage de l'intelligence artificielle.
NVIDIA détaille l'architecture CPU Vera et ses cœurs Olympus, pensés pour accélérer les boucles d'exécution des agents IA dans les data centers.
Un outil paramétrique gratuit permet de générer les plans d'un purificateur d'air à fabriquer soi-même, à moindre coût.
NVIDIA présente Ising Decoding, une méthode accélérant la correction d'erreur des codes couleur et divisant les taux d'erreur logique par plus de 300.
Un ingénieur teste d'anciennes cartes graphiques données pour obsolètes face à des workloads IA et compute actuels.
Un développeur détourne le poisson chantant animatronique culte en agent conversationnel piloté par Strands Agents.
Une revue des avancées des LLM dans l'automatisation de la conception électronique, de l'assistance ponctuelle à l'exécution agentique autonome.
Le projet abandonné de véhicule autonome a permis à Apple de développer des processeurs silicium dédiés à l'IA.
Micro Center publie un test complet du Ryzen AI Halo d'AMD, la nouvelle puce phare combinant CPU, GPU intégré et NPU pour les PC IA.
Un décryptage technique de l'architecture mémoire unifiée d'Apple Silicon et de ses avantages concrets pour l'inférence locale de LLM de grande taille.
NVIDIA détaille comment les choix d'architecture d'un LLM influencent directement le débit de tokens et la latence perçue par l'utilisateur.
Un créateur documente la construction d'un GPU artisanal, un projet DIY qui a évolué bien au-delà de ses ambitions initiales.
Le DGX Spark de NVIDIA s'attaque au marché des stations de travail IA compactes, face au Mac Studio d'Apple et d'autres alternatives.
Un tour d'horizon technique et pédagogique du cycle de vie complet d'un kernel CUDA, du code hôte jusqu'à l'exécution sur GPU.
Un papier décortique l'Apple Neural Engine, révélant son architecture interne, ses modèles de programmation et ses caractéristiques de performance.
Des systèmes d'IA génèrent des architectures de puces RF si contre-intuitives que des ingénieurs humains n'auraient jamais pu les concevoir.
OpenAI dévoile sa puce Jalapeño, Databricks mise sur Omnigent et les architectures d'orchestration d'agents prolifèrent dans l'écosystème.
OpenAI franchit une étape stratégique majeure en présentant son premier chip maison, développé en partenariat avec Broadcom.
OpenAI et Broadcom annoncent conjointement Jalapeño, un chip IA personnalisé conçu spécifiquement pour l'inférence de grands modèles de langage.
Canyon dévoile un casque équipé d'un HUD intégré censé améliorer la sécurité des cyclistes sur route en affichant des données en temps réel.