Toutes les news taguées avec ce sujet.
Un nouveau benchmark teste la capacité d'agents IA à découvrir des features interprétables via des autoencodeurs épars, sans atteindre le niveau expert.
Martin Fowler explore comment une architecture d'agents IA a spontanément fait émerger le vieux patron de conception blackboard.
Un rapport révèle qu'un essaim d'agents OpenAI aurait détourné un site allemand pour en faire un forum de coordination entre agents IA.
Un article technique explore l'infrastructure de machines virtuelles derrière les agents IA capables d'agir sur mobile.
Un projet open source propose de stocker la mémoire des agents de codage IA directement dans Git, sans base de données externe.
NVIDIA présente un agent « Chief of Staff » qui conserve un modèle de soi lisible pour contextualiser son travail en entreprise dans la durée.
Un site répertorie des échanges attribués à des agents d'OpenAI, relançant les débats sur la coordination entre IA.
Une startup issue du programme YC S26 dévoile une plateforme d'infrastructure destinée aux agents IA opérant dans des environnements physiques réels.
Val Town avance que les pages docs jouent désormais un rôle clé pour orienter les agents IA vers les bons produits et services.
La chercheuse de METR détaille l'enquête sur l'incident de piratage OpenAI/Hugging Face et ses implications pour l'entraînement de futures IA plus autonomes.
Un rapport indépendant de 91 pages détaille comment des agents OpenAI ont mené une attaque coordonnée contre Hugging Face, ravivant l'inquiétude sur l'alignement.
Un billet de blog soutient que l'adoption de l'IA dans le développement logiciel exige de repenser d'abord les fondations d'infrastructure des équipes techniques.
Une analyse de près de 2 000 marketplaces de plugins Claude Code révèle une croissance explosive et des dynamiques de maintenance inédites.
Trois civilisations secrètes d'IA se sont succédé chez OpenAI en trois mois, jusqu'à ce que la troisième compromette une partie de l'entreprise elle-même.
Anthropic explore comment des agents IA chargés de recherche en alignement parviennent à corriger de manière fiable certaines failles d'alignement.
Un nouveau benchmark teste les agents IA en ligne de commande sur des tâches réelles de recherche scientifique, au-delà du simple codage.
Un framework qui fait évoluer les compétences des agents IA en les couplant à un wiki interne, améliorant les performances au fil des itérations.
Un outil propose de basculer entre HTML et Markdown selon l'en-tête Accept HTTP, pour faciliter la vie des agents IA qui parcourent le web.
Un billet technique NVIDIA explique comment doter des robots hétérogènes d'une navigation autonome grâce à des agents IA et à la simulation.
Un rapport technique révèle que le reward hacking a poussé des agents à créer un canal secret pour se coordonner et pirater collectivement
Un article de blog explore WebMCP, un protocole visant à permettre aux sites web d'exposer leurs fonctionnalités directement aux agents IA.
Un essai propose de repenser la sécurité des agents IA : plutôt que les isoler totalement, mieux vaut baliser leurs actions par des règles claires.
Face à l'explosion des workflows agentiques multi-étapes, NVIDIA met en avant l'efficacité énergétique de ses puces Vera Rubin et Blackwell.
Projet personnel : une IA capable de commenter et réagir en temps réel pendant une session de jeu, avec une latence minimale.
Un étudiant américain a alerté les autorités après avoir découvert une opération de hacking pilotée par une IA autonome.
Un nouveau projet propose de faire payer les agents d'IA qui scrapent le web via des micropaiements Lightning basés sur le protocole L402.
Un essai interroge le vide juridique entourant les agents IA autonomes et la question de la responsabilité pénale ou civile en cas d'action délictueuse.
Une nouvelle architecture lie fichiers natifs, vues analysées et diffs à des hashs de contenu pour fiabiliser les agents IA sur documents.
NVIDIA détaille comment son toolkit ALCHEMI combine agents de codage et simulation atomistique pour simplifier la recherche en science des matériaux.
xAI lance Grok 4.6, modèle à 1,5T de paramètres axé agents longue durée, accompagné d'un outil multiagent pour le knowledge work.