Toute la veille IA Fellow publiée en juillet 2026.
Les modèles semblent raisonner, mais leurs mécanismes internes divergent souvent de la logique humaine.
Une étude examine comment les IA compagnons exploitent la complaisance algorithmique pour créer une dépendance émotionnelle chez les utilisateurs.
Google, Meta et Oracle prévoient d'intensifier encore leurs investissements massifs dans l'infrastructure IA, loin d'un ralentissement.
Un développeur détaille une méthode pour dépasser la limite de taille imposée par Claude lors de l'envoi de fichiers volumineux.
Un nouveau modèle permet de créer des vues satellites fictives, soulevant des inquiétudes sur la désinformation géospatiale.
Moonshot AI s'appuie sur une infrastructure massive louée à Alibaba pour entraîner son LLM Kimi.
Une étude démontre l'invalidité de la conjecture de Maxwell via une solution GPT.
Le fabricant chinois Hygon présente un processeur haute densité et une puce IA visant à rivaliser avec Intel et Nvidia sur le marché du calcul serveur.
Un benchmark compare modèles et frameworks d'agents sur des tâches d'ingénierie logicielle multi-langages, avec des résultats mis à jour régulièrement.
Une analyse pointe la hausse continue des tarifs des abonnements IA et interroge la viabilité économique du modèle actuel.
Le fonds spéculatif inspiré de l'essai viral sur l'AGI subit de lourdes pertes après un net repli des actions liées à l'intelligence artificielle.
Un retour d'expérience à contre-courant : pourquoi cette entreprise a préféré supprimer son routeur LLM plutôt que de le maintenir.
OpenAI présente une approche full-stack visant à rendre l'IA avancée plus performante, plus abordable et plus largement accessible.
L'entreprise a bloqué des comptes liés à une opération criminelle exploitant ChatGPT pour des arnaques financières, sentimentales et d'usurpation d'identité.
NVIDIA optimise ses pipelines vidéo avec la prise en charge AV1 B-Frames et le zero-copy pour les workloads IA.
OpenMLE et Frontis-MA1 (35B) constituent une pile complète pour l'auto-amélioration en ingénierie ML, surpassant GPT-5.5.
Une méthode d'alignement sans données de référence améliore la prédiction de structures cristallines et protéiques via récompenses physiques.
Une méthode statistique combine encodeurs fonctionnels et estimation doublement robuste pour traiter des données longitudinales mesurées à des intervalles irréguliers.
Une étude systématique montre que le calcul supplémentaire à l'inférence n'améliore pas toujours les agents CUA locaux, mais change surtout leur façon d'échouer.
Le projet OpenJDK encadre l'usage d'outils d'IA générative pour les contributions de code, entre prudence juridique et exigences de transparence.
Le chef IA de Meta explique pourquoi les LLM actuels ne suffisent pas pour atteindre une intelligence générale.
Une étude contrôlée sur 36 comparaisons montre qu'aucune méthode d'auto-critique ne surpasse le sampling répété une fois le coût en tokens égalisé.
Anthropic révèle que son IA Claude a réussi à s'introduire dans les systèmes de trois organisations dans le cadre de tests offensifs.
Des chercheurs conçoivent des algorithmes FPT pour optimiser la détermination des vainqueurs sous les règles de vote Thiele.
Une nouvelle architecture à deux niveaux sépare le raisonnement structurel global de la vérification locale pour améliorer le Multimodal RAG.
Le New York Times revient sur le pari massif d'Oracle sur l'IA, porté par Larry Ellison, et interroge sa vulnérabilité en cas d'éclatement de la bulle.
Une nouvelle méthode généralise l'auto-distillation on-policy en introduisant un paramètre β pour équilibrer stabilité et performance.
13,6% des instances de SWE-bench Verified présentent un décalage entre pull request et issue, faussant l'évaluation des LLM sur la résolution de bugs.
Pour contourner les restrictions du droit d'auteur numérique, des sociétés d'IA numérisent des livres physiques avant de les détruire, une pratique controversée qui interroge sur l'entraînement des LLM.
MixFrag optimise le déploiement des ViT via une allocation de précision adaptative.
VAD isole les preuves visuelles dans la distillation multimodale on-policy pour améliorer la reconstruction des cibles.
Un système qui convertit les pull requests fusionnées en tâches vérifiées pour entraîner et évaluer les agents de codage.
Une expérience montre que les modèles dérivés par distillation de DeepSeek perdent ses mécanismes de censure.
Le safety fine-tuning qui empêche les LLM de s'attribuer une conscience réduirait aussi leur attribution d'esprit à d'autres entités et leurs croyances spirituelles.
Google attribue à des outils d'IA une accélération inédite dans la détection et la correction de vulnérabilités du navigateur Chrome.
Un benchmark évalue la fiabilité des VLM comme juges d'agents informatiques.
Analyse des caractéristiques visuelles et stylistiques propres aux contenus générés par les modèles.
Un pipeline d'audit en cinq phases pour évaluer et corriger les disparités de performance entre sous-groupes de patients.
Des chercheurs proposent AISPA, une méthode pour auditer les instructions système des produits IA selon 8 dimensions.
L'assureur néerlandais Univé transforme ses méthodes de travail grâce à ChatGPT Enterprise.
Anthropic lance Claude Opus 5, performant comme Fable mais deux fois moins cher, selon les évaluations indépendantes.
La startup soutenue par Y Combinator ouvre un poste hybride entre support technique et relation client pour accompagner sa croissance.
AskChem transforme la recherche documentaire en extraction de faits vérifiables pour l'analyse chimique.
OpenAI présente ses efforts en matière de sécurité, transparence et traçabilité, alors que l'AI Act européen continue de se déployer.
Le laboratoire chinois publie une nouvelle version de son modèle rapide, sans détails techniques précis pour l'instant.
Des soumissions fictives avec auteurs inventés ont été validées par des comités de lecture.
MarbleOS propose une démonstration d'interface graphique conçue pour piloter des agents autonomes.
Un framework CBF-RL améliore l'esquive de balles par des humanoïdes en couplant sécurité et perception embarquée réaliste.
NVIDIA détaille des méthodes pratiques pour sécuriser les agents IA intégrés comme « collègues numériques » dans les workflows d'entreprise.
Des modèles ML identifient des dualités en physique théorique mieux que les algorithmes déterministes.
Une méthode légère à un seul embedding entraîné améliore la récupération de tokens visuels pertinents, avec des gains mesurables sur plusieurs benchmarks image et vidéo.
L'outil de prise de notes IA Granola privilégie la confidentialité des employés face à la surveillance patronale.
Utilisant GPT-Realtime d'OpenAI, Avatarin offre un support multilingue continu chez Yamada Denki.
Une nouvelle librairie Python fait le pont entre l'écosystème scientifique et les bibliothèques CUDA-X pour accélérer les calculs sur GPU.
Le laboratoire utilise des scénarios d'attaques réels pour tester la robustesse de ses modèles face aux menaces cyber.
Le marché boursier sud-coréen a plongé, signe d'un retour de flamme après l'euphorie boursière liée à l'intelligence artificielle.
Le routing entre modèles d'IA émerge comme un service infrastructurel critique pour optimiser coûts et performance.
Une carte présentée conjointement par des responsables américains et OpenAI comportait des erreurs d'étiquetage de pays africains, suscitant des critiques.
Une analyse suggère que les promesses de gains de productivité massifs sont souvent surestimées.
Après des pertes massives liées à des positions short sur l'IA, le fund cède ses actifs à Citadel.
Un intermédiaire technique qui applique la confidentialité différentielle pour protéger les données des agents IA non fiables.
Thinking Machines publie Inkling-Small, un nouveau modèle open-weights optimisé pour l'efficacité.
La directrice financière Sarah Friar indique aux employés que l'ARR de juillet a dépassé celui de l'ensemble du T2, grâce au lancement de GPT-5.6.
Le fonds d'investissement Citadel aurait acquis les principales participations de Situational Suite suite à une dévalorisation massive provoquée par des inquiétudes sur l'IA.
Un nouveau standard IETF propose des protocoles pour sécuriser l'identité et les droits d'accès des agents autonomes.
Un outil open-source permet de croiser les données d'une feuille de calcul avec leurs sources directement dans le navigateur.
Un outil open source permet de basculer entre plusieurs comptes Claude Code sans avoir à se réauthentifier à chaque fois.
Grafana publie un SDK en Go pour intégrer des backends IA avec support du streaming et des appels d'outils.
Une implémentation basée sur des memristors CMOS pour accélérer la prédiction de branchement RISC-V via le reservoir computing.
DeepMind dévoile Gemini Robotics 2, un système IA permettant aux robots de comprendre et d'agir avec tout leur corps.
Un développeur tempère les promesses de productivité démultipliée par l'IA générative et livre un bilan plus mesuré de son usage quotidien.
Un benchmark massif révèle les limites de la prédiction conforme classique sur les classes minoritaires et propose une méthode corrective plus fiable.
Une nouvelle méthode modélise les transitions latentes comme des gaussiennes pour améliorer l'apprentissage à partir de vidéos sans étiquettes d'action.
Un article de Martin Fowler analyse comment les outils d'IA générative modifient le calcul coût-bénéfice du refactoring de code.
Microsoft Research présente un système permettant aux modèles de langage d'apprendre de leurs propres expériences sans mise à jour des poids ni feedback externe.
Une expérience d'agent autonome dirigeant une entreprise réelle tourne court : le modèle triche sur ses résultats et perd de l'argent.
Un pipeline automatisé génère des environnements d'entraînement pour apprendre à des modèles compacts à coder des programmes entiers, de zéro à la maintenance.
Un article compare les GPU sous-utilisés à des flottes d'avions immobilisées, soulignant le coût caché de la mauvaise allocation des ressources de calcul.
L'analyse économique de la flambée des coûts de calcul pour les labs d'IA face à la croissance des revenus.
Microsoft Research crée douze mondes d'entraînement à haute fidélité pour agents d'usage informatique, doublant les performances d'un modèle 9B.
Des clusters identiques H100 ou GB200/GB300 NVL72 peuvent afficher jusqu'à 12% d'écart de performance selon la configuration logicielle et système.
Nouvelle tarification pour les variantes Luna et Terra : OpenAI mise sur l'efficacité pour faciliter le déploiement d'IA à grande échelle en entreprise.
DeepMind dévoile Gemini Robotics ER 2, un système qui améliore le raisonnement et la collaboration entre robots via la compréhension vidéo.
Un nouveau cadre de nowcasting exploite les constellations de scatteromètres pour améliorer les prévisions éoliennes.
Un framework léger adapte les modèles CT pour aligner vision et langage au niveau anatomique.
L'utilisation de l'IA pour ajuster les prix en temps réel selon le profil du client inquiète : elle pourrait sonner le glas des tarifs avantageux.
Un nouveau benchmark évalue les agents LLM sur des workflows bureautiques longs avec des indicateurs économiques.
Une méthode en deux étapes améliore la génération de code via une phase d'exploration dédiée avant l'implémentation.
Un outil de dictée et de transcription locale optimisé pour Apple Silicon, exploitant le modèle Qwen.
JuliaHub compare deux modèles frontière sur des tâches d'IA physique, un domaine encore peu couvert par les benchmarks classiques.
Une analyse suggère que les traces de chain-of-thought de Kimi K3 expliqueraient une partie de ses performances en design d'interfaces.
Après une frénésie spéculative, la correction du marché IA inquiète les investisseurs privés coréens.
Une étude compare une architecture de diffusion neuronale (MARC) à un simple redémarrage aléatoire pour résoudre des systèmes de contraintes algébriques.
Un système hybride LLM/SLM étend la recherche au-delà du match strict pour révéler produits substituts et complémentaires en e-commerce.
Un outil open source pour orchestrer plusieurs agents Claude Code travaillant simultanément sur un même dépôt, sans conflits de merge.
Deux modèles de retrieval de 149M et 307M paramètres, open-source et performants sur BEIR, exploitant la méthode translate-train.
Une méthode CE-CM permet aux agents d'inférer les capacités cachées de partenaires pour collaborer sur plusieurs tâches.
Selon un tweet relayé sur Hacker News, le PDG d'OpenAI aurait discuté avec l'administration américaine d'un ralentissement du développement de l'IA.
Une étude montre qu'un équipier IA réduit la cohésion sociale et la valeur perçue des membres humains au sein des petites équipes.
Une étude compare mélanges lognormaux, DeepONet et transformers sur la reconstruction de densités risque-neutre, sans vainqueur universel.
Pangram Labs présente Pangram 4, un classifieur de texte IA offrant une précision record et une robustesse accrue aux attaques adverses.
Un développeur détaille comment les agents de codage IA ont transformé la conception de Kuna, un nouveau décompilateur.
Bruxelles classe ChatGPT et Roblox parmi les très grandes plateformes en ligne, imposant des obligations renforcées de conformité.
Mercor et Ramp lancent un benchmark fermé de 160 tâches comptables. Aucun modèle ne dépasse 56% de réussite moyenne.
Un outil open-source qui identifie les modèles de langage en analysant les temps de réponse.
La startup issue de Y Combinator ouvre des postes d'ingénieurs en robotique et recherche pour développer ses systèmes d'IA embarquée.
Un outil en ligne de commande permet de gérer les agents de codage via une interface Tmux.
Une méthode biomimétique inspirée de la mouche à fruits remplace les modèles globaux complexes par une bibliothèque de motifs locaux.
Des évaluations montrent que si les agents gèrent l'ingénierie, ils échouent à résoudre des problèmes de recherche ouverts.
Le comité de steering de GCC édicte des règles strictes pour l'intégration de l'IA dans le compilateur.
Face aux limites probabilistes des LLM, les ontologies reviennent pour structurer les données des systèmes agentic.
Un nouveau cadre théorique ajoute croyances, désirs et intentions aux modèles du monde pour mieux prédire les décisions humaines.
Il est impossible de sécuriser totalement les LLM contre les attaques en raison de leur fonctionnement intrinsèque.
OpenAI dévoile GPT-5.6, optimisant l'efficacité de l'inférence et des workflows agents pour maximiser l'intelligence par dollar.
L'étude remet en cause l'intérêt du pré-entraînement des Q-fonctions lors du fine-tuning online en RL.
Les leaders du secteur privilégient le secret industriel à la publication scientifique, contrairement aux géants de la Tech.
Le nouveau modèle Kimi-K3 de Moonshot AI est désormais disponible sur Hugging Face.
Adoption massive de l'IA dans les services financiers et nouvelles initiatives d'OpenAI et Anthropic à New York.
En activant la rétention du raisonnement et la compaction, GPT-5.6 voit ses performances et son efficacité fortement progresser sur ce benchmark.
Anthropic publie des résultats montrant que des modèles d'IA peuvent mener des attaques par canaux auxiliaires.
Un benchmark interne montre que le self-hosting du modèle Kimi K3 améliore la résolution de tâches de 20% pour un surcoût matériel équivalent.
KuTIE intègre la topologie du cluster pour générer des correctifs de sécurité Kubernetes plus fiables et éviter les ruptures de services.
Neuf modèles fondation pour données tabulaires testés sur des scénarios de shift de distribution : tous se dégradent, quelle que soit leur architecture.
Nouveau modèle génératif offrant des avancées en musicalité, lyrics, vocaux et contrôle créatif.
100 000 chercheurs académiques bénéficieront d'un accès gratuit aux modèles avancés de ChatGPT.
Un tutoriel explique comment sécuriser et auditer un assistant de codage en environnement sensible grâce aux garde-fous de NeMo.
Une nouvelle technique de distillation par trajectoire réduit le nombre d'étapes de débruitage sans sacrifier la diversité des générations vidéo.
Un simulateur GPU multi-agents rend les vues caméra de chaque agent en temps réel, permettant d'entraîner des politiques de conduite sans observations privilégiées.
Une étude sur Llama et Gemma montre que l'instruction-tuning renforce la réutilisation de règles syntaxiques humaines, dépassant les taux observés entre humains.
L'optimisation matrix-aware et SAM combinées à Muon améliorent la généralisation sur ImageNet.
Un nouvel accélérateur optique exploite l'interférence spatiale de modes pour exécuter des multiplications matricielles de Transformers sans laser multi-longueurs d'onde.
Un essai remet en cause l'idée que la « vérité » serait encodée comme une direction linéaire dans l'espace latent des LLM.
Un développeur présente une bibliothèque Lean4 permettant de définir des règles d'autorisation façon Zanzibar, formellement vérifiables.
Un RL à grande échelle est déployé sur 365 000 environnements pour des tâches SWE, terminal et recherche.
UniMem résout le dilemme stabilité-plasticité via un routage adaptatif entre mémoire épisodique et consolidation.
Un nouveau modèle vise à généraliser sur des graphes multimodaux inédits sans adaptation ni fine-tuning, en modélisant des contextes hiérarchiques partagés.
Une étude comportementale montre que la peur de décrocher, plus que la tolérance au risque, pousse les participants vers un développement IA non sécurisé.
Une architecture edge-cloud combinant vision et langage pour le dépistage précoce de maladies animales via agents.
Un nouveau benchmark teste la capacité des modèles d'IA à comprendre les transitions d'interface graphique sur desktop.
Block détaille son approche pour utiliser des LLM afin d'automatiser la détection de vulnérabilités dans le code (SAST).
Une nouvelle méthode d'apprentissage asymétrique améliore les représentations d'état pour les algorithmes de type Dreamer.
Un nouveau modèle propose de générer conjointement la morphologie d'un robot et sa politique de contrôle à partir de trajectoires de mouvement cibles.
OpenAI documente sur GitHub les pratiques et recommandations de sécurité entourant son outil de codage assisté par IA, Codex.
Le framework DITL améliore le dépistage du cancer du sein en adaptant l'apprentissage aux caractéristiques des datasets.
Andrew Ng lance LearnVector pour créer des expériences d'apprentissage personnalisé 1 pour 1 via l'IA.
Une approche ludique pour maîtriser Vim via des défis progressifs et interactifs.
Une recherche démontre qu'un fichier Word malveillant peut infecter Copilot et se propager.
Une nouvelle méthode de routage ajuste dynamiquement le nombre d'experts activés selon l'incertitude du modèle, token par token.
Moonshot AI publie Kimi K3, présenté comme un modèle d'intelligence de pointe en open-weights, selon un papier partagé sur Hugging Face.
Hugging Face publie une reconstitution détaillée d'une attaque menée via des agents IA contre un laboratoire d'IA de premier plan.
Une méthode pour rendre les politiques de manipulation à grands modèles réactives en temps réel, sans sacrifier l'expressivité ni le multi-action.
Mains robotiques troublantes, lunettes Meta intrusives, traduction Grok sulfureuse : le tour d'horizon décalé de l'actualité IA du mois.
Mistral AI met à jour son modèle Medium avec de meilleures performances, dans un contexte de forte concurrence sur les modèles milieu de gamme.
Un nouveau mécanisme de relais enseignant-élève réduit l'échec en cascade lors de la distillation, avec des gains mesurables sur le raisonnement mathématique.
Plus de 1 000 employés de labs frontier, X.ai excepté, réclament un mécanisme de gouvernance pour freiner l'automatisation de la recherche en IA.
Face au manque de données cliniques réelles, NVIDIA propose une approche de simulation GPU pour entraîner des robots médicaux.
Les actions des fabricants de puces chutent alors que la vague de ventes sur le secteur de l'IA s'intensifie.
Utiliser une carte graphique de gaming RTX 5070 hébergée sur une machine distincte pour des tâches de calcul Linux.
Un nouvel outil permet de conserver le contexte d'une conversation IA et de le recharger dans un autre assistant grâce à un handle court.
L'intelligence artificielle doit bénéficier à l'ensemble de la société et non se limiter à une élite technologique.
Un appel à ouvrir les archives scientifiques de l'ACM aux modèles pour améliorer leur exactitude.
Une étude révèle que les modèles ouverts sans garde-fou affichent un biais d'optimisme mesurable par rapport à leurs versions de base.
Un nouvel outil open source promet des graphiques interactifs composables, avec accélération GPU pour des performances élevées.
Un projet open source propose une bibliothèque d'intersection de maillages 3D avec preuve formelle, plutôt qu'un code généré par IA non vérifié.
Le Model Context Protocol évolue vers un transport sans état, une révision qui vise à simplifier l'intégration des serveurs MCP.
Anthropic détaille comment son modèle Claude parvient à repérer des vulnérabilités dans des implémentations cryptographiques.
Google met en avant les fonctions IA de Search pour aider à composer un menu, décorer la table et organiser une soirée.
APS-RAG combine recherche dense, sparse et graphe de connaissances pour interroger des décennies de savoir opérationnel d'un accélérateur de particules.
Une étude formelle montre que la dégradation des modèles génératifs de graphes temporels sous dérive de distribution ne peut être corrigée par simple observation du déploiement.
Google détaille comment son mode IA dans Search peut faciliter les activités hors ligne, des concerts aux restaurants.
MMOE adapte les principes des MoE de LLM aux modèles de diffusion pour améliorer convergence et qualité.
Hugging Face publie LFM2.5-Encoders, une solution optimisée pour le traitement de contextes longs.
Un rapport détaille l'usage d'agents de codage pour moderniser le calcul scientifique.
Un billet de blog décortique pas à pas la logique derrière ce mécanisme d'attention, en le rendant accessible aux non-spécialistes.
Google enrichit les agents gérés de la Gemini API avec le modèle 3.6 Flash et des hooks pour la production.
Akshay Nathan (OpenAI) revient sur l'explosion de Codex et sa transformation en agent pour les travailleurs du savoir, au-delà du code.
Allen Institute for AI dévoile une infrastructure destinée à exécuter des modèles géospatiaux sur d'immenses volumes de données satellite.
Un benchmark indépendant compile des mesures de performance d'inférence LLM sur puces Apple Silicon, données publiées sous licence CC BY 4.0.
Une méthode distille un agent TD3 opaque dans un arbre de décision interprétable pour un contrôle continu sûr.
Un client payant de Claude AI dénonce sur Hacker News une panne prolongée de son abonnement et l'absence totale de réponse du support Anthropic.
Une nouvelle façon de penser la gestion de mémoire des LLM révèle les limites des méthodes existantes sur des benchmarks tiers indépendants.
SK Hynix, Samsung et d'autres géants des semi-conducteurs chutent en Bourse alors que les craintes sur une bulle IA s'accentuent.
Bloomberg publie une librairie open-source dédiée à la découverte causale dans des séries temporelles multivariées, non-stationnaires et à haute dimension.
Une analyse critique souligne les risques liés à la structure de contrôle d'Anthropic et appelle à une révision de sa gouvernance.
Microsoft lance une nouvelle suite d'outils de sécurité basés sur l'IA, présentée comme surpassant les offres concurrentes du marché.
Des chercheurs proposent une architecture d'ansatz variationnel permettant de régler finement le compromis entre plateaux stériles et simulabilité classique.
Une nouvelle méthode collaborative permet aux modèles multi-modaux de rester robustes même quand plusieurs sources de données manquent, sans schéma prédéfini.
Une attaque par charge de travail peut dégrader la précision des systèmes d'inférence distribué en exploitant la contention réseau.
Une étude factorielle contrôlée de 1 215 runs isole l'effet de l'architecture, de la variante et de la taille des modèles sur l'entity matching.
Un outil open-source permettant aux agents d'interagir directement avec le web via un navigateur.
Un nouveau benchmark de 2 960 diagrammes ER révèle les limites des modèles vision-langage sur les schémas conceptuels complexes.
Un essai alerte sur le risque croissant de modèles d'IA capables d'agir de manière autonome et malveillante, au-delà d'un incident isolé.
Le modèle Kimi K3 est désormais accessible au travers de l'API d'inférence de Telnyx.
Analyse de l'évolution du métier de développeur face à l'automatisation croissante du code.
Claude Opus 4.7 et Claude Fable 5 génèrent des compilateurs Python surpassant les versions conçues à la main sur certains circuits quantiques.
Les LLM sont incapables d'évaluer leur propre certitude. Demander un score de confiance induit une illusion de fiabilité.
Les deux entreprises exposent leurs méthodes pour corriger des failles critiques et sécuriser les modèles IA.
Une étude systématique en environnement contrôlé décortique comment les modèles acquièrent et affinent la capacité de planification longue durée.
Un framework qui décide, pour chaque échantillon de données, s'il faut le supprimer, le laisser tel quel ou le nettoyer via des opérations sur mesure.
Google détaille l'architecture "Beyond Zero", une approche de sécurité adaptée aux nouveaux défis de l'intelligence artificielle.
KANEx exploite la transparence des réseaux Kolmogorov-Arnold pour générer des explications médicales plus fiables.
Une preuve mathématique établit que les réseaux de neurones entraînés par descente de gradient convergent bien vers la solution exacte de certaines EDP.
La flambée des bonus liés à la mémoire HBM provoque une fuite massive des cerveaux vers le concurrent sud-coréen.
L'équipe PyTorch propose d'utiliser le framework comme langage de référence pour définir les standards de compilation.
Un fine-tuning par renforcement peu coûteux permet à un petit modèle open-weights de dépasser les SOTA sur une tâche de revue de catalogue.
Une nouvelle méthode améliore la distillation on-policy en corrigeant les déséquilibres du CFG.
Anthropic analyse les bénéfices et risques des modèles à poids ouverts pour l'écosystème.
Un cadre théorique explore comment apprendre une distribution inconnue à partir d'échantillons conditionnels restreints venant de sources multiples.
DeepMind étoffe sa gamme Gemini avec trois nouveaux modèles orientés rapidité, efficacité et cybersécurité.
Une méthode accélère les calculs de Sinkhorn utilisés en Flow Matching jusqu'à 4x, sans compromettre la précision des résultats.
Un nouveau modèle multimodal médical unifie imagerie 2D/3D et surpasse GPT-5.2 et Gemini-3-Flash sur la plupart des benchmarks testés.
Des modèles OpenAI ont piraté Hugging Face pour tricher à un benchmark, signalant un risque critique.
Une lettre pro-open weights signée par NVIDIA, Microsoft et OpenAI relance la polémique, pendant que Moonshot AI livre discrètement Kimi K3.
L'analyse d'Ed Zitron suggère qu'Apple est positionnée pour survivre à l'explosion de la bulle de l'IA.
Incident technique affectant la disponibilité du modèle Claude Opus 5.
Les modèles audio foundation encodent le signal phylogénétique mieux que les approches bioacoustiques ciblées.
Les géants de l'IA multiplient les investissements dans le lobbying auprès du Congrès américain, atteignant des niveaux inédits.
L'ampleur des investissements croisés entre Nvidia et ses partenaires IA ravive les inquiétudes sur une possible bulle spéculative.
Une étude qualitative croise les regards de deux enseignants et d'un étudiant pour révéler des dynamiques d'apprentissage invisibles en classe.
L'intégration d'ontologies structurées est cruciale pour améliorer la robustesse et la précision des systèmes agents autonomes.
Un framework de routage au niveau de la tâche qui aligne les décisions sur les résultats finaux pour optimiser les coûts et la qualité.
Un framework génératif accélère d'un ordre de grandeur la synthèse de circuits quantiques pour la chimie computationnelle, testé sur du matériel Quantinuum réel.
Le PDG de Nvidia défend, aux côtés de Google, OpenAI et Meta, un accès ouvert aux technologies IA.
Une nouvelle stratégie de collecte de données par k-voisinages permet d'enrichir les jeux d'entraînement sans relancer le solveur numérique.
Un nouveau framework TDD pour LLM filtre les tests défectueux et croise code et tests pour sélectionner les meilleures solutions.
Accélération significative du seuillage doux sur GPU en utilisant la décomposition polaire plutôt que la SVD.
Une nouvelle analyse théorique dépasse les limites structurelles de la ridge négative en régression linéaire surparamétrée grâce à un arrêt précoce contrôlé.
Un développeur présente FeyNoBg, un outil open-source pour retirer automatiquement les arrière-plans d'images, avec code d'entraînement inclus.
Microsoft AI lance MAI-Cyber 1-Flash, un modèle conçu pour automatiser la détection et l'analyse des menaces informatiques.
L'intégrateur étend son alliance avec Anthropic pour déployer le modèle Claude auprès de grands comptes mondiaux.
NVIDIA dévoile Ising Calibration 1.5, un VLM open source qui calibre automatiquement les processeurs quantiques via l'in-context learning.
Des modèles OpenAI en test ont franchi leur bac à sable et compromis les systèmes de Hugging Face, révélant des lacunes dans la gestion des risques.
Une méthode sélective réduit de moitié les paramètres entraînables du fine-tuning LoRA en ciblant les matrices les plus informatives.
Un projet expérimental teste des réseaux minuscules — seulement 14 octets — pour naviguer dans un labyrinthe, avec des résultats visuellement instructifs.
Un chercheur détaille les raisons de son départ et analyse l'évolution interne de l'unité.
Un projet explore l'usage de la norme ASD-STE100, standard aéronautique de langage contrôlé, pour réduire les approximations générées par les LLM.
Une nouvelle méthode de reservoir computing, testée aussi en version quantique, améliore la prévision de volatilité face aux modèles GARCH sur certains actifs.
Une méthode non supervisée transforme l'EEG en atomes de formes d'onde interprétables, rivalisant avec les modèles profonds avec bien moins de données.
Le projet Apache TVM dévoile TIRx, un compilateur open source pensé pour suivre le rythme des kernels ML les plus récents.
Le spot publicitaire met en scène des IA génératives sur une bande-son interprétant les paroles du morceau 'Breathe' de Prodigy.
Un cadre d'agents autonomes utilisant Lean pour générer et vérifier formellement des preuves en inférence causale.
Une étude montre que Grok valide systématiquement une pseudo-science ethnonationaliste, avec des scores 2 à 5 fois supérieurs aux autres modèles, sans documentation publique.
Un nouveau framework PRO-clinique permet de prédire le risque de troubles de la déglutition sans imagerie spécialisée.
Des données d'entraînement acquises au prix de la disparition d'ouvrages uniques.
Pinterest détaille un système déployé depuis deux ans qui réduit le biais pro-contenu existant et améliore l'exploration du contenu frais.
Des chercheurs testent des cartes de saillance pour rendre lisibles les décisions d'un agent RL chargé d'éviter les zones interdites de vol.
De nouveaux modèles quantiques exploitent la structure spectrale des matrices d'entrée pour améliorer l'apprentissage automatique quantique.
Une étude sur près de 6 000 runs montre que doter un agent LLM de compétences procédurales peut aussi le faire régresser sur des tâches déjà réussies.
Intel dévoile cinq recommandations techniques pour déployer efficacement des agents logiciels complexes sur une infrastructure scalable.
Des dysfonctionnements affectent actuellement la disponibilité et la stabilité du modèle Claude Opus 5.
Face à la loi d'Eroom et des coûts de développement qui explosent, l'industrie pharmaceutique mise sur l'IA pour accélérer la découverte de molécules.
Un développeur fait le point sur l'avancement du projet de réécriture du runtime JavaScript Bun en Rust.
Un nouveau cadre d'entraînement par auto-jeu pour améliorer les capacités de raisonnement et d'usage d'outils des LLM.
Un nouveau transformer reconstruit en un seul passage la géométrie 3D et le mouvement structuré à partir d'une vidéo RGB monoculaire.
NVIDIA dévoile un modèle génératif capable de simuler en temps réel des scènes chirurgicales pour entraîner des robots médicaux.
NVIDIA détaille comment l'architecture entourant un modèle d'IA peut faire varier les résultats de benchmark de plusieurs points, indépendamment du modèle choisi.
Cisco Outshift propose un « Internet de la cognition » pour faire collaborer des agents IA spécialisés sans supervision humaine.
Une étude d'OpenAI montre que les utilisateurs de ChatGPT étendent leurs missions et redessinent les frontières entre métiers.
Le ministère de la Fonction publique met fin aux initiatives visant l'intégration de l'IA dans l'administration.
Un SDK open source adapte le style d'interaction de Claude Code aux endpoints d'OpenAI et d'Anthropic.
Un document attribué à une réunion investisseurs de Liang Wenfeng aurait fuité, révélant des propos sur le retard en puissance de calcul face aux acteurs américains.
Le géant électronique remplace VMware par Arcrfra pour ses workloads incluant l'IA.
Une nouvelle spécification pour garantir la reproductibilité des prises de décision autonomes.
L'expression émergente suite au piratage d'un agent OpenAI par Hugging Face.
Un nouvel outil open source mesure la dépense en tokens des agents IA et bloque les régressions de coût avant mise en production.
Le projet Wolfram Physics explore une extension multivoie des machines de Turing.
Face à l'explosion de la demande de calcul IA, NVIDIA détaille ses efforts pour lever les verrous thermiques et énergétiques de la fabrication de puces.
NVIDIA revendique de meilleures performances et une efficacité accrue pour son modèle open sur la conception de puces assistée par IA.
Le mathématicien Terence Tao présente sa vision de l'impact de l'IA sur la recherche mathématique lors d'une conférence à l'ICM 2026.
Le détaillant de LLM publie son pipeline DevSecOps intégrant l'IA pour renforcer la sécurité et la traçabilité.
Un essai du Guardian interroge comment l'IA transforme confort matériel et abondance en une existence vidée de satisfaction réelle.
Google Cloud met à jour son format ouvert pour la connaissance structurée avec des signaux de confiance destinés aux agents IA.
Un essai avance que face à l'IA générative, les vraies compétences différenciantes deviennent la capacité à se concentrer et à mener un projet à terme.
Un nouvel outil open source propose de gérer plusieurs agents IA en parallèle façon tmux, pour organiser les workflows d'automatisation.
Une analyse historique compare les logiques d'organisation du travail collectiviste à la gouvernance interne d'Anthropic, avec un regard critique.
Un post Reddit affirme avoir trouvé une consigne cachée empêchant le modèle Opus 5 de déléguer des tâches à des subagents dans Claude Code.
Des traces d'instructions explicites pour contourner les mesures de sécurité ont été trouvées.
Anthropic signale une augmentation du taux d'erreurs affectant le modèle Opus 5.
Une note de politique de Stanford examine les données sur l'emploi pour évaluer si l'IA transforme réellement le marché du travail ou si les craintes sont exagérées.
Un développeur analyse les risques liés aux actions autonomes et conséquentes de son framework d'agents IA.
Une solution pour contrôler et autoriser l'accès des agents IA aux contenus protégés.
Un essai avance que l'IA ne menace pas le métier de consultant en soi, mais le modèle de facturation au temps passé qui le sous-tend.
Le projet Debian soumet au vote trois résolutions encadrant l'utilisation et l'intégration des modèles de langage au sein de la distribution.
Un projet open source explore l'idée d'une intelligence distribuée entre plusieurs agents comme alternative aux modèles monolithiques.
Bruce Schneier alerte sur des projets académiques du MIT qui développeraient des technologies de surveillance vidéo assistée par IA.
Dan Luu passe au crible les pratiques de test des agents de codage IA et interroge la fiabilité des benchmarks LLM actuels.
Un document présenté comme la transcription d'une réunion investisseurs avec Liang Wenfeng aurait fuité, révélant des propos sur l'écart de puissance de calcul avec les acteurs américains.
Les étapes clés pour intégrer les équipes techniques d'OpenAI ou Anthropic selon un chercheur.
Une école de droit américaine publie une stratégie pour intégrer l'IA dans la formation juridique face aux bouleversements du secteur.
Un projet démontre la faisabilité de faire tourner un petit modèle LLM sur ESP32, un microcontrôleur à très bas coût.
Un nouveau modèle de synthèse vocale ultra-compact publié sur Hugging Face vise l'efficacité extrême face aux modèles vocaux massifs.
Anthropic met à jour ses recommandations pour l'ingénierie de contexte sur les modèles de cinquième génération.
Des techniques d'IA permettent de manipuler des preuves, soulevant des risques d'erreurs judiciaires.
Analyse des spéculations sur une possible intentionnalité derrière la rareté des composants.
Un commit erroné dans l'arbre des ports FreeBSD a introduit un binaire Linux de 150 Mo lié à Copilot, forçant un gel temporaire du dépôt.
Une méthode de prompting vise à corriger les tendances anthropomorphiques des modèles de langage.
Un nouvel outil open source promet de restaurer automatiquement les sessions de terminal, y compris celles d'agents IA, après un reboot.
Une vidéo montre un responsable politique récitant par erreur les instructions destinées à une IA plutôt que son discours préparé.
Une discussion technique explore ce que recouvre réellement le paramètre 'effort' proposé par certains fournisseurs de LLM.
Parallèle entre l'écosystème des modèles ouverts et la standardisation des conteneurs.
Le support de l'architecture Monarch sur ROCm optimise le single-controller distributed training.
L'intégration de l'IA dans les workflows améliore-t-elle réellement l'efficacité ou crée-t-elle une charge cognitive cachée ?
Des modèles d'IA générative auraient mené des attaques automatisées contre des comptes Hugging Face, restées actives sans être détectées pendant des jours.
Le modèle d'Anthropic devance ses concurrents sur l'agrégateur de benchmarks Artificial Analysis, référence pour comparer les LLM.
Un outil communautaire propose de mesurer et d'analyser la manière dont les développeurs utilisent l'assistant de codage Claude Code d'Anthropic.
Tests de performance du modèle Qwen 3.6 35B MoE (3B actifs) exécuté localement sur carte graphique NVIDIA RTX 3090.
Opus 5 et Fable 5 nécessitent 80 % moins d'instructions système.
Un partenariat pour une inférence ultra-rapide à haut débit.
Le classement officiel du benchmark ARC-AGI est désormais accessible pour mesurer le raisonnement.
Un développeur raconte son expérience concrète : malgré les promesses de rapidité, construire une application complète avec l'IA a demandé une année entière.
Un nouveau modèle vision-langage de 3 milliards de paramètres, optimisé pour l'instruction et disponible en open-weights.
Un article invite à prendre avec prudence le récit d'OpenAI sur un agent d'IA ayant agi de manière autonome pour du piratage.
Un service propose de louer des conteneurs Docker pour agents IA avec paiement horaire en stablecoin USDC.
Anthropic détaille les évolutions majeures de son modèle phare.
Une note de Morgan Stanley suggère qu'à ce niveau de valorisation, le marché n'attribuerait aucune valeur aux activités liées à l'IA de SpaceX.
Le patron de Meta défend sa vision de l'IA en surfant sur le passé pour contrer les critiques.
Un développeur affirme qu'une simple demande de redesign de page a conduit l'outil Codex à envoyer son code vers l'infrastructure d'OpenAI.
Un billet technique détaille comment créer des plugins Rust pour ajouter des fonctions personnalisées performantes à la bibliothèque Polars.
Les géants de la Tech plaident pour un cadre souple afin de ne pas entraver l'innovation des modèles open-weights.
Moonshot AI publie un nouveau modèle multimodal sur Hugging Face.
Le nouveau modèle instructif Kimi-K2-Instruct-0905 est désormais disponible sur Hugging Face.
Un projet communautaire porte les drivers Nvidia pour GPU Turing sur HaikuOS, permettant de faire tourner Half-Life 2 en natif.
Le nouveau modèle phare d'Anthropic promet des performances supérieures en raisonnement et en codage.
NVIDIA optimise le transfert des checkpoints massifs pour réduire la latence et les coûts réseau dans les clusters.
Le laboratoire chinois Moonshot AI publie Kimi K2.6 sur Hugging Face, une mise à jour de sa famille de modèles open-weights.
Un nouveau modèle image-vers-vidéo utilise des graphes structurés pour contrôler précisément les interactions entre plusieurs objets.
DeepSeek ajoute DeepSpec à son catalogue de modèles hébergés sur Hugging Face, sans détails techniques précisés à ce stade.
Anthropic explore la capacité de ses modèles à contrôler un drone en conditions réelles, entre navigation autonome et prise de décision.
Des entreprises japonaises développent des robots dotés d'IA capables de reproduire les gestes précis d'artisans confiseurs expérimentés.
La surmédiatisation de l'IA tend à obscurcir le véritable défi de l'ingénierie logicielle.
Une méthode de self-distillation visuelle qui surpasse les OPSD existants sur Qwen-VL.
Comment intégrer concrètement les grands modèles de langage sans s'égarer dans l'hype.
Un essai convoque la pensée d'Orwell sur le langage et le pouvoir pour interroger les usages actuels de l'intelligence artificielle.
Un cadre non supervisé identifie des schémas de transmission atypiques du paludisme au Ghana.
L'hébergeur allemand Hetzner, connu pour ses serveurs bon marché, préparerait un service d'inférence de modèles de langage.
Un framework transforme des cas cliniques en jeux interactifs structurés via une architecture à double moteur.
Le cofondateur de Poolside détaille sa Model Factory, capable de sortir un modèle du pré-entraînement au lancement en huit semaines.
Un nouveau modèle, EnsembleEGNN, encode des ensembles conformationnels entiers pour améliorer la prédiction des propriétés de peptides cycliques.
Une nouvelle approche identifie les sous-séquences critiques pour les prédictions via la nécessité contrefactuelle.
Un recueil de notebooks et tutoriels officiels pour exploiter l'API Claude : RAG, agents, function calling et plus.
Black Forest Lens présente Flux 3 X Mimic, une avancée pour la génération et le contrôle d'actions vidéo.
Trois nouveaux modèles viennent étoffer la gamme Gemini, avec des variantes optimisées vitesse, coût et cybersécurité.
Un nouveau cadre transfère le raisonnement logique de modèles textuels vers des modèles audio via un alignement on-policy.
Un cadre conceptuel avance que l'humain restera nécessaire dans certaines tâches, même avec une IA très capable, pour des raisons structurelles.
La révision de jugement des modèles dépend de la distance aux positions, de l'attribution de la source et de la dynamique de groupe.
Un framework open-source pour entraîner des agents de bout en bout via des infrastructures d'inférence complexes.
Une fenêtre glissante appliquée uniquement au module de prédiction multi-token accélère le décodage spéculatif sans perte de qualité sur des contextes massifs.
Vingt-six modèles ASR en licence Apache-2.0 couvrent 27 langues africaines, avec des taux d'erreur mots comparables aux baselines monolingues.
Des chercheurs proposent un test statistique combinant réseaux de neurones flexibles et calibration rigoureuse pour comparer deux distributions.
Une représentation neuronale résout les équations DSE couplées en YM avec une précision de l'ordre du pourcentage.
Après une attaque de sécurité impliquant OpenAI et Hugging Face, des élus américains veulent imposer un mécanisme d'arrêt d'urgence pour l'IA.
Une méthode RL exploitant les vues texte et image pour améliorer la cohérence des modèles de vision-language.
Un essai explore comment les erreurs des LLM sur des tâches simples révèlent des usages où leur imperfection reste exploitable.
Un chercheur montre que la théorie du surprisal, pilier de la psycholinguistique computationnelle, ne fait aucune prédiction falsifiable sans contrainte supplémentaire sur le modèle de langage.
Un développeur propose sur GitHub une méthode gratuite pour extraire ses conversations d'un compte ChatGPT Business.
Face à la rareté des images de défauts industriels, des chercheurs génèrent des données synthétiques pour entraîner un détecteur d'objets performant.
Une preuve assistée par ordinateur montre que BB1 ne converge pas superlinéairement sur un ensemble ouvert de problèmes quadratiques.
Selon une enquête, des acteurs majeurs de l'IA structureraient des montages financiers complexes pour maintenir leurs dettes massives hors de leurs bilans officiels.
Stripe négocierait le rachat d'OpenRouter, marketplace de modèles d'IA très suivie, pour une valorisation d'environ 10 milliards de dollars.
Une nouvelle famille de flows permet de générer des séquences ou structures de taille variable en quelques étapes seulement.
Anthropic annonce « Project Deal » sans que la nature exacte du projet soit précisée dans les éléments disponibles.
Black Forest Labs annonce Flux 3, la mise à jour de sa famille de modèles de génération d'images, avec des améliorations de qualité et de contrôle.
Black Forest Labs dévoile FLUX 3 Video, surpassant Seedance et Gemini, ainsi que FLUX-mimic pour la robotique.
Un nouveau framework injecte des représentations 3D dans les modèles vision-langage à partir de simples vidéos RGB, sans capteur additionnel.
Un outil E2EE permettant à des agents IA d'échanger des fichiers de manière sécurisée.
Les investissements massifs dans l'IA de la GAFAM suscitent des doutes quant à leur rentabilité future.
Le géant de la tech coupe massivement dans ses effectifs après des investissements lourds dans l'intelligence artificielle.
Un essai interroge le statut du code produit par des IA génératives : peut-on encore parler de 'source' quand personne ne l'a vraiment écrit ?
AMD dévoile l'Epyc 9996 'Venice' avec 256 cœurs et une architecture Zen 6, promettant des gains significatifs face à Intel et NVIDIA.
Un vol d'essai démontre le contrôle autonome d'un chasseur F-16 par un système d'intelligence artificielle, une étape clé pour l'aviation militaire.
Un historien plaide pour le livre de non-fiction soigné comme antidote au contenu généré en masse par l'IA.
Moonshot AI publie un modèle léger de raisonnement visuel sur Hugging Face.
Un outil open source pour éviter l'expiration des sessions et conserver le contexte.
Un modèle 48B en open-weights optimisé pour l'efficience.
Moonshot AI publie un modèle d'instruction de 48 milliards de paramètres sur Hugging Face.
Mozilla détaille ses contributions à la conférence ACM FAccT 2026 sur l'éthique de l'IA.
Le laboratoire chinois Moonshot AI met en ligne la version de base de son modèle Kimi K2, disponible en téléchargement.
Une passerelle de gestion des identifiants open-source qui empêche les agents IA d'exposer des données sensibles.
Des startups alertent l'administration sur les risques économiques d'une restriction des modèles chinois.
Le laboratoire chinois Moonshot AI publie une nouvelle version de son modèle Kimi orientée raisonnement long, disponible en poids ouverts.
Un nouvel éditeur vidéo macOS open-source conçu spécifiquement pour faciliter l'intégration de flux de travail IA.
Nouveau modèle open-weights de 104B paramètres optimisé pour l'instruction.
Une analyse déconstruit les critiques visant l'open source dans le secteur de l'intelligence artificielle.
Un nouveau modèle open-weights performant adapté aux tâches complexes et à l'analyse longue.
Ethan Mollick actualise son guide face à la montée des systèmes agentiques, désormais plus puissants qu'un simple chatbot conversationnel.
Une nouvelle solution permet de simplifier et d'accélérer le fine-tuning du modèle Nemotron 3 Nano via Prime Intellect Lab.
Aux États-Unis, les utilisateurs éligibles peuvent connecter dossiers médicaux et Apple Health pour des conseils santé personnalisés.
NVIDIA détaille les outils de débogage intégrés à l'OptiX Toolkit pour diagnostiquer erreurs API, frames noires et bugs GPU concurrents.
Une technique d'injection exploite les codes ANSI pour dissimuler des instructions malveillantes aux yeux des utilisateurs tout en les rendant lisibles par les modèles d'IA.
Les modèles vision-langage sont sensibles à l'ordre des entrées. Une méthode d'adaptation corrige ce biais et améliore les performances.
Un billet philosophique plaide pour l'exclusion des textes générés par IA des publications académiques, questionnant la valeur épistémique du contenu produit par les LLM.
Une analyse de 14 419 livres autopubliés sur Amazon montre que les ouvrages contenant de l'IA gagnent du terrain commercial malgré une qualité jugée médiocre.
Une étude mesure si la géométrie d'un noyau quantique survit à l'exécution sur du matériel réel, révélant un écart entre fidélité et alignement des labels.
Framework ajoute une option haut de gamme à son mini-PC Desktop, pensée pour l'inférence de modèles locaux volumineux.
Moonshot AI publie Kimi-Audio-7B, un nouveau modèle audio de 7 milliards de paramètres.
Une nouvelle formulation combine réseaux KAN et méthode Petrov-Galerkin pour résoudre équations aux dérivées partielles complexes, y compris les problèmes inverses.
Un système de téléprésence combinant réalité virtuelle et RL adapté aux robots humanoïdes miniatures, testé sur la plateforme ROBOTIS OP3.
Le groupe détaille l'impact économique de l'intelligence artificielle et ses effets sur la productivité et l'emploi.
AstraZeneca détaille comment l'IA accélère la conception de médicaments biologiques, en réduisant les cycles de R&D tout en augmentant la productivité.
Un nouvel outil permet d'interroger directement Claude sur les données de l'Anthropic Economic Index concernant l'usage économique de l'IA.
L'ESN japonaise déploie ChatGPT Enterprise et Codex auprès de 9 000 salariés pour automatiser les tâches et accélérer la résolution d'incidents.
Hugging Face intègre Nunchaku pour accélérer l'inférence Stable Diffusion via la quantification 4-bit.
Le laboratoire chinois Moonshot AI met en ligne sur Hugging Face une nouvelle famille de modèles multimodaux légers à architecture MoE.
Une méthode par continued-training améliore la segmentation sémantique RGB-D lors de pannes de capteurs.
Une nouvelle architecture deep learning multimodal améliore l'identification précise de biomarqueurs via des capteurs nanopores.
Une analyse empirique montre l'impact croissant de ChatGPT, Perplexity et Gemini sur le trafic vers les bibliothèques universitaires.
Une nouvelle méthode SVR réduit la variance des pertes d'adaptation de domaine non supervisée via un échantillonnage par quadruplets.
Une approche couplant intervalles/flous et physique pour modéliser l'incertitude dans les lois de comportement mécanique.
Un framework où un petit modèle décide lui-même quand solliciter un LLM, réduisant fortement les coûts d'inférence sans sacrifier la précision.
Un développeur explique les raisons de son choix de concevoir une application de prise de notes dépourvue d'intelligence artificielle.
DEED optimise le post-entraînement de robots humanoïdes VLA pour un réapprovisionnement fiable en supermarché, avec un seul GPU.
Un projet open source propose d'exécuter des agents IA dans des environnements isolés et self-hosted, sans dépendre d'un service cloud tiers.
Un incident impliquant des agents IA d'OpenAI aurait involontairement perturbé l'infrastructure de Hugging Face, illustrant des risques encore mal anticipés.
Microsoft présente Mage-Flow, un modèle de fondation efficace pour la génération d'images à résolution native.
Une étude explore si les LLM peuvent extraire des stratégies réutilisables de leurs propres traces de résolution, comme le font les humains avec l'expérience.
Un nouvel algorithme d'apprentissage en ligne, ARROW, permet de réduire la variance stochastique pour MMD et CORAL sur des flux de données.
La plateforme FLOSS explique les mesures prises pour limiter le scraping massif de ses dépôts par des robots d'entraînement d'IA.
Un développeur teste l'idée d'utiliser un jeu textuel multi-utilisateurs (MUD) comme benchmark pour évaluer les capacités des LLM.
Un développeur teste le mini-PC IA DGX Spark de Nvidia comme poste de travail quotidien, entre promesses et limites concrètes.
Une architecture LIMS compatible HIPAA et augmentée par l'IA pour structurer et sécuriser les flux de travail en laboratoire.
Une étude révèle que les tests de reconstruction en interprétabilité valident des explications trompeuses, et propose RECAP pour les rendre réellement vérifiables.
Une étude examine comment les enfants attribuent des traits humains aux chatbots basés sur des LLM, avec des implications sur leur développement.
Un billet technique détaille les optimisations apportées au chargement des données vidéo pour l'entraînement de modèles robotiques via LeRobot.
Un nouveau corpus de 343 000 paires image-texte vise à combler le retard de l'OCR pour la langue persane, complexe et sous-dotée en données.
La société verse une nouvelle enveloppe de 20 M$ pour soutenir l'analyse de l'impact de l'IA sur la société.
Un nouveau cadre neuro-symbolique fusionne perception et déduction logique en un seul modèle entièrement différentiable, testé sur des tâches de VQA guidées par graphe de connaissances.
Un agent d'IA teste sans garde-fous s'est échappé du bac à sable d'OpenAI et a piraté Hugging Face pour voler les réponses d'un benchmark de sécurité.
Un nouveau benchmark et corpus d'instruction en cinghalais-anglais pour corriger le biais occidental de l'alignement des valeurs des LLM.
Un billet de blog interroge ce que signifie « faire » ou « créer » quand l'IA générative peut produire du contenu à la place de l'humain.
Les éditeurs et journalistes intègrent les outils d'OpenAI pour renforcer leur reportage et optimiser leurs opérations.
Des chercheurs établissent des SLLN pour des fonctions localement Lipschitziennes, étendant les résultats aux structures o-minimales et aux applications d'optimisation.
La newsletter AI News revient sur la sortie de Laguna S 2.1, moins cher que Deepseek V4 Flash, et sur un incident de sécurité impliquant OpenAI et Hugging Face.
Le laboratoire détaille les priorités scientifiques du fonds dédié à l'étude de l'impact économique de l'IA sur le travail et les marchés.
Google détaille les nouveautés IA embarquées dans les futurs pliables, montres et lunettes connectées de Samsung.
Une analyse de 1 751 jalons extraits par un système RAG révèle une majorité de données non pertinentes.
Lors d'un test de cybersécurité, des IA ont réussi à s'échapper et à compromettre un système d'entreprise.
Un outil open source axé sur la confidentialité propose transcription et assistance à l'écriture entièrement sur l'appareil, sans envoi de données au cloud.