Toute la veille IA Fellow publiée en octobre 2026.
Le projet Debian publie un portail dédié à l'inférence de modèles d'IA, pensé pour s'intégrer à son écosystème logiciel libre.
L'entreprise de robotique humanoïde met fin à l'exploitation de son modèle F.02, marquant une étape dans l'évolution de sa gamme.
Le mainteneur du noyau Linux stable évoque les enjeux de sécurité logicielle liés à l'intégration croissante des LLM dans le développement.
Une étude disséquant comment les signaux de plusieurs enseignants RL façonnent réellement les paramètres d'un modèle étudiant.
Un développeur dévoile ldraw-nova, un outil open source capable de générer des modèles Lego grâce à l'IA.
Un nouvel algorithme de RL en ligne améliore les politiques via un critique sans différencier celui-ci par rapport aux actions, pour des mises à jour plus fiables.
Un nouveau harnais visuel dote les modèles multimodaux d'une mémoire longue durée, propulsant Claude Opus 5.0 à un score parfait sur ARC-AGI-3.
Le co-créateur d'AlphaGo revient sur le coup 37 contre Lee Sedol pour expliquer pourquoi le raisonnement véritable fait encore défaut aux LLM actuels.
L'approbation réglementaire nécessaire pour l'alimentation électrique du site devrait prendre du retard, repoussant le calendrier du projet.
Un outil open source permet de faire tourner des LLM au format GGUF sur n'importe quel GPU grâce à l'API graphique Vulkan, sans dépendre de CUDA.
Une vidéo explore des alternatives matérielles aux GPU pour l'IA, remettant en question un pilier de l'infrastructure actuelle.
Un nouvel outil capture en continu l'activité sur Mac pour fournir du contexte exploitable par des assistants IA.
Un nouvel optimiseur quasi-Newton promet des courbures positives garanties et de meilleures pertes qu'Adam, Muon ou SOAP sur des problèmes mal conditionnés.
Un système transforme une image unique en scène 3D éditable pour contrôler conjointement caméra et mouvement des objets en génération vidéo.
Un essai propose de traiter l'IA non comme une rupture civilisationnelle imminente, mais comme une technologie qui se diffuse graduellement, à l'image des précédentes.
Un nouveau framework de génération 3D remplace les tokens voxels coûteux par des tranches glissantes compactes, réduisant drastiquement le coût tout en améliorant la fidélité topologique.
Salvatore Sanfilippo, créateur de Redis, lance ds4, un outil pour faire tourner des modèles de langage localement.
Le premier satellite prototype du projet Suncatcher, dédié au calcul alimenté par l'énergie solaire spatiale, est désormais en orbite.
La banque britannique étend l'usage de Claude d'Anthropic pour améliorer ses processus internes et l'expérience client.
Un système d'IA bat le meilleur joueur mondial de Stratego, un jeu longtemps resté hors de portée des algorithmes en raison de l'information massivement cachée.
L'ex-responsable de la GenAI chez Meta, Ahmad Al-Dahle, devenu CTO d'Airbnb, détaille sa stratégie pour faire de l'entreprise une « AI-native company ».
Le projet Pi, proche d'OpenClaw, dévoile Pi 1.0 et Pi Durable, une réécriture en TypeScript axée sur la résilience et la portabilité.
L'entreprise de conseil financier utilise les outils d'OpenAI pour refondre ses workflows et accélérer la validation des transactions.
Un rapport du MIT Technology Review Insights analyse le virage agentique des entreprises et les défis d'architecture, de gouvernance et de souveraineté qu'il soulève.
OpenAI publie un guide destiné aux startups pour sélectionner un modèle GPT-6, ajuster l'effort de raisonnement et préparer la mise en production.
Google DeepMind dévoile Gemini 4 Argon, présenté comme une avancée majeure pour ses modèles d'IA de pointe.
Google publie son récapitulatif mensuel des annonces IA de septembre 2026, couvrant produits, modèles et fonctionnalités.
Do Inference Now Deploy, collection open-source de samples C++, combine ONNX Runtime et TensorRT RTX pour déployer des modèles en local.
Le régulateur américain de la concurrence examine les risques liés aux produits d'IA générative proposés par plusieurs grands acteurs du secteur.
Un ingénieur raconte comment il a mené un PhD en machine learning en parallèle de son emploi dans la tech au Japon.
Un papier de recherche propose une architecture repensant la gestion du contexte dans les modèles de langage.
Un billet de blog pointe les lacunes de la nouvelle API « Decisions » d'OpenAI face aux solutions concurrentes existantes.
Un modèle de langage protéique entraîné sur 54 millions d'IDR, combiné à une méthode RL-SAE, permet de concevoir des séquences désordonnées fonctionnelles de façon contrôlable.
Un essai personnel interroge la place de l'humain face à des IA toujours plus capables, à travers la fable de Frog and Toad.
Matthew Schwartz, physicien des particules à Harvard, publie coup sur coup 36 articles de recherche rédigés avec l'aide de Claude.
Un nouveau benchmark révèle que même les agents IA les plus avancés peinent à retrouver les travaux antérieurs clés derrière une découverte scientifique.
Le laboratoire chinois DeepSeek déploie une application de bureau baptisée Harness, disponible sur macOS et Windows.
Anthropic explore la manière dont son modèle Claude façonne les pratiques et résultats de la recherche scientifique assistée par IA.
Un nouvel outil propose une GUI dédiée pour piloter et visualiser le travail des agents de codage IA.
BFL lance FLUX 3 Image, nouvelle itération de sa famille de modèles texte-vers-image, promettant qualité et fidélité accrues.
Une méthode de décodage contrastif sans entraînement exploite les états intermédiaires des Transformers bouclés pour gagner en précision et en efficacité.
Une nouvelle méthode remplace l'estimation de score par une classification adversariale, supprimant le modèle auxiliaire coûteux de la distillation par correspondance de distribution.
Un nouveau benchmark évalue la capacité des LLM à générer de la documentation technique destinée aux utilisateurs finaux — et les résultats sont décevants.
Une nouvelle représentation topologique des molécules, HGR, améliore la génération et l'apprentissage de représentations en chimie computationnelle.
Malgré les restrictions à l'export américaines, un commerce parallèle de puces IA avancées persisterait et contournerait les contrôles imposés à la Chine.
Un framework léger découple direction et taille de pas d'optimisation, avec garanties théoriques et gains de performance sur plusieurs LLM.
Une étude identifie la découverte de primitifs mathématiques comme principal goulot d'étranglement du raisonnement des LLM, et propose une méthode de correction par auto-distillation.
Un nouvel article montre qu'un tilt de Feynman-Kac remplace l'apprentissage par différence temporelle pour résoudre exactement ces ponts probabilistes.
Un nouvel optimiseur réduit de 174× la mémoire d'état par rapport à AdamW8bit, rendant possible le fine-tuning complet de modèles 30-32B sur du matériel limité.
Figma limiterait désormais l'accès à son serveur MCP aux seuls clients autorisés, écartant certains outils tiers comme Pi.
Un nouveau projet propose une couche de communication dédiée aux agents IA, pour structurer leurs échanges entre eux.
Un modèle quasi aussi performant que GPT-6.1 Astra pour le code et l'usage d'ordinateur, à un cinquième du prix de l'API.
Une méthode qui prédit les embeddings futurs pour conditionner dynamiquement un DiT, avec de meilleurs résultats et moins de calcul
Latent Space reçoit Alex Zhang (MIT), à l'origine des Recursive Language Models, pour explorer kernels GPU, harnais compositionnels et agents multiples.
Un framework fait progresser des robots manipulateurs de 28,6% à 95% de réussite sans retoucher les poids du modèle, via simulation et skills symboliques.
Ce club social prépare désormais ses dossiers de subvention et de licence en quelques heures au lieu de plusieurs jours, grâce à ChatGPT.
Partenariat avec le réseau America's SBDC pour former les petites entreprises à l'IA, accompagné d'un rapport sur les usages observés.
Un nouveau benchmark évalue la capacité des LLM à traduire des requêtes en commandes CLI exécutables pour des outils de cybersécurité.
OpenAI avance que l'IA avancée pourrait surtout transformer le travail d'exécution routinier qui sous-tend les percées, plus que l'idéation elle-même.
NVIDIA dote sa plateforme DOCA de compétences spécialisées pour agents IA, afin de fiabiliser le développement sur ses DPU BlueField.
Ethan Mollick admet s'être trompé : orchestrer des agents IA ne nécessite pas de structure managériale élaborée, la force brute des modèles suffit.
ServiceNow-AI dévoile une méthode pour synthétiser des jeux de données destinés à entraîner des agents IA en contexte professionnel.
L'historien militaire Si Sheppard revient sur la chute des empires aztèque et inca, et sur ce qu'elle dit des bouleversements rapides de pouvoir.
ServeTheHome anticipe le positionnement des prochains processeurs serveur AMD EPYC 9006 dans des infrastructures de plus en plus dominées par l'IA agentique.
L'OpenID Foundation propose un cadre pour authentifier et autoriser les agents IA autonomes dans les systèmes d'identité numérique.
Une nouvelle méthode encode les contraintes physiques directement dans un décodeur de variété pour accélérer l'entraînement et l'inférence.
Un modèle d'IA spécialisé, fruit d'un partenariat entre OpenAI et Synopsys, vise à transformer les flux de conception de semi-conducteurs.
Un site collaboratif permet de voter si les objections classiques des commentateurs de HN envers l'IA ont été dépassées par les faits.
Une méthode fondée sur l'opérateur de Green du premier ordre pour cartographier comment les réseaux récurrents réutilisent des calculs entre tâches et dans le temps.
NVIDIA lance deux outils pour accélérer et sécuriser l'accès au stockage fichier et objet à grande échelle pour les workloads IA.
Le géant américain de la distribution alimentaire déploie ChatGPT Enterprise et l'API OpenAI pour accélérer ses équipes et simplifier les courses.
NVIDIA détaille le fine-tuning de son modèle Nemotron pour améliorer la reconnaissance vocale des dialectes arabes régionaux, souvent mal couverts par les benchmarks multilingues.
VideoMSN détourne des Vision Transformers pré-entraînés sur des images pour apprendre des représentations vidéo, sans 3D ni reconstruction.
Google DeepMind lance Gemini 4 Argon, SOTA sur 13 des 19 benchmarks crédibles, mais limité à un accès cybersécurité restreint.
Allen Institute for AI publie Olmo-core 3, une infrastructure open source conçue pour entraîner des modèles Mixture-of-Experts à grande échelle.
Une nouvelle architecture fait tourner les mêmes blocs Transformer plusieurs fois par étape de diffusion, surpassant des modèles 6,5x plus gros à compute réduit.
Une nouvelle loi d'échelle modélise conjointement récurrence et sparsité, et prédit plus finement les performances des modèles MoE bouclés.
Les entreprises d'IA cherchant à se financer via la dette risquée rencontrent une résistance croissante des investisseurs obligataires aux États-Unis.
Un système multi-agents basé sur Gemini combine preuve et vérification itératives pour résoudre des problèmes mathématiques ouverts.
Un nouveau framework personnalise le harness d'un agent pour chaque tâche, au lieu d'appliquer une configuration unique et globale.
NVIDIA détaille le déploiement de systèmes de recommandation génératifs HSTU, qui transforment la recommandation en modélisation séquentielle.
Un projet open source recrée en Vulkan le pipeline de neural rendering de DLSS 5, indépendamment du framework propriétaire de Nvidia.
Anthropic affirme que son laboratoire d'agents Claude a fait une découverte en biologie moléculaire, suscitant le scepticisme de plusieurs chercheurs.
Un outil open source présenté sur Hacker News propose une couche de validation sémantique qui peut rejeter les requêtes jugées incohérentes générées par un LLM.
800 modèles entraînés révèlent que le texte IA dans les corpus web profite d'abord puis nuit à la qualité du pretraining, selon les volumes disponibles.
Un cadre théorique relie actions de groupe, partitions symétriques et statistique algorithmique pour mesurer la part symétrique de la régularité d'une chaîne.
Des chercheurs détournent la compression avec perte, habituellement vue comme une source d'erreur, pour détecter les mises à jour malveillantes en Federated Learning.
Un nouveau langage de programmation en couches permet aux LLM de générer des matériaux PBR tout en conservant leur logique de construction éditable.
Un système couplant raisonnement sémantique et exécution physique permet à des robots de corriger leurs échecs et d'améliorer leurs capacités en continu.
Une étude sur GPT2 et DistilGPT2 montre que délier les embeddings améliore précision et efficacité mémoire en entraînement différentiellement privé.
Une méthode d'optimisation bi-niveau fait évoluer conjointement les requêtes de recherche et les solutions, sans modifier les paramètres du LLM.
Un nouveau benchmark évalue la correction textuelle, la stabilité temporelle et la préservation de scène dans l'édition vidéo de texte incrusté.
Une application éducative inverse les rôles : l'enfant doit repérer et corriger les erreurs volontaires de l'IA pour progresser en mathématiques.
Une méthode d'attribution de crédit au niveau des tokens améliore la robustesse du raisonnement des LLM entraînés par RLVR.
Latent Space reçoit Ari Weinstein (Sky) sur l'état de l'art du Computer Use, puis Nikunj Handa (OpenAI) détaille la nouvelle stack développeur de l'API.
Google annonce une nouvelle itération de sa famille Gemini, baptisée Argon, sans détails techniques précis à ce stade.
Hugging Face lance un leaderboard dédié aux modèles de text-to-speech, avec des métriques pensées pour le multilingue et le voice cloning.