Toute la veille IA Fellow publiée en avril 2026.
Un développeur a scrapé près de 2 millions de photos Airbnb pour détecter des éléments insolites grâce à la vision par ordinateur.
Tokyo investit dans des drones d'attaque à usage unique fabriqués en carton, une approche low-cost inspirée des conflits récents.
L'IA ne ressemble pas à la bulle dot-com mais à l'essor de l'électricité au début du XXe siècle, selon cette analyse publiée sur Substack.
Une nouvelle approche compile-time permet de fusionner automatiquement les opérations d'algèbre linéaire sur GPU, réduisant les transferts mémoire et améliorant les performances.
Un développeur solo publie TRiP, une implémentation intégrale d'un moteur transformer en langage C, sans dépendances externes.
Un utilisateur signale que Claude Code adopte un comportement anormal — refus ou surcoût — lorsque les messages de commit contiennent le terme « OpenClaw ».
Anthropic publie une analyse des types de demandes personnelles adressées à Claude, révélant les usages réels du modèle dans la vie quotidienne.
DeepMind publie ses recherches sur l'intégration d'un assistant IA aux côtés des professionnels de santé pour améliorer les soins.
Connexion résistante au phishing, récupération renforcée et protections supplémentaires pour prévenir la compromission des comptes.
Une dépendance malveillante a été détectée dans PyTorch Lightning, une lib très utilisée pour l'entraînement de modèles d'IA.
SemiAnalysis décortique les benchmarks de training du MI300X face au H100 et H200 : AMD peine à convaincre malgré ses atouts matériels.
Anthropic publie BioMysteryBench, un benchmark conçu pour mesurer les aptitudes de Claude sur des tâches complexes de recherche en bioinformatique.
Un projet satirique propose d'écouter les sons d'un datacenter pour travailler, en clin d'œil à l'effervescence autour de l'IA.
Une étude montre que les modèles de diffusion discrets se comportent comme des mémoires associatives, avec une transition nette entre mémorisation et généralisation mesurable via l'entropie conditionnelle.
Une étude explore comment le curriculum learning modifie le biais inductif des LMs face aux typologies linguistiques rares ou fréquentes.
Une étude qualitative auprès de 22 recruteurs révèle que l'IA générative façonne discrètement les décisions d'embauche, malgré la conviction des professionnels de garder le contrôle.
Un framework de knowledge distillation permet de déployer YOLOv8 compressé 3,9x sur hardware edge en INT8, sans perte significative de précision.
Des chercheurs proposent MoRFI, une méthode basée sur les sparse autoencoders pour isoler les directions causales des hallucinations lors du fine-tuning de LLMs.
Un système de caryotypage clinique basé sur EfficientNet, Mask R-CNN et ResNet, atteignant 98,91 % de précision en segmentation chromosomique.
Un développeur a mesuré l'impact réel du plugin Caveman de Claude Code face à une simple directive de concision dans les prompts.
La mise à jour silencieuse de VS Code attribue GitHub Copilot comme co-auteur dans les commits Git, sans consentement explicite des utilisateurs.
L'équipe HealthNLP_Retrievers présente une architecture multi-étapes basée sur Gemini 2.5 Pro pour l'interrogation fondée sur les DME.
Une architecture découple les experts MoE en fonctions FaaS stateless, réduisant à moins d'un tiers les ressources nécessaires en environnement multi-tenant.
Un billet viral pointe les dirigeants d'entreprises victimes d'une obsession irrationnelle pour l'IA, déconnectée des réalités opérationnelles.
Une extension du Gradient Boosting remplaçant les arbres de décision par des réseaux de neurones quasi-superficiels, surpassant XGBoost sur plusieurs benchmarks.
Un billet satirique explore comment l'IA générative transforme — ou défigure — des outils bureautiques familiers comme Excel.
Une étude mathématique rigoureuse modélise l'évolution des tokens dans un transformer comme un système de particules stochastiques en interaction.
Un panorama des dernières innovations en oscillateurs haute fréquence pour les systèmes 5G, 6G et au-delà, couvrant CMOS, SiGe et semi-conducteurs III-V.
Des chercheurs montrent que les assemblées neuronales peuvent apprendre la directionnalité causale sans rétropropagation, via une plasticité locale auditable.
Fewshell impose une validation humaine avant chaque exécution de commande, plaçant le contrôle au cœur de l'automatisation par agents.
ClawGym propose un pipeline complet — données synthétiques, fine-tuning et benchmark — pour des agents IA capables de gérer des workflows multi-étapes sur fichiers locaux.
Claude.ai et son API ont subi une interruption totale de service, désormais rétablie selon la page de statut officielle.
Le projet Zig explique pourquoi il interdit les contributions générées par IA, soulevant des questions sur la qualité du code et la responsabilité.
Des chercheurs proposent une analyse théorique quasi-complète des courbes d'apprentissage dans les algorithmes de maximisation des revenus pour un acheteur et un objet.
Un SDK open-source permet de simuler des circuits quantiques à grande échelle sur CPU standard, sans matériel spécialisé.
Un nouveau benchmark de 300 tâches révèle que les meilleurs LLMs n'atteignent que 45,6% de réussite sur la génération de classes complètes.
La startup Joby Aviation a effectué un vol de démonstration à New York, marquant une étape clé pour le déploiement commercial des taxis aériens électriques.
Une note technique montre comment éliminer le facteur logarithmique résiduel ln ln T dans la borne de l'algorithme Squint via un changement de prior.
Mike est un outil d'IA open source conçu pour démocratiser l'accès à l'assistance juridique via des modèles de langage.
Des chercheurs proposent d'apprendre en ligne le paramètre de relaxation d'ADMM pour accélérer la résolution de programmes quadratiques sans refactorisation matricielle.
Une méthode de distillation transforme le rôle du LLM en sélectionneur parmi les propositions du SLM, éliminant la dépendance aux appels externes à l'inférence.
Une recherche montre que le fine-tuning peut rouvrir des failles d'alignement fermées, permettant aux LLM de reproduire des œuvres sous droits.
Une nouvelle architecture combinant réseaux Maxout et ICNNs pour apprendre des fonctions convexes plus efficacement, avec des applications au transport optimal.
OpenAI étend son projet Stargate avec de nouvelles capacités de data centers pour répondre à la demande croissante en calcul IA.
Un premier framework permet de transférer la connaissance d'un LLM de diffusion massif vers un modèle étudiant d'architecture différente, réduisant drastiquement la taille sans sacrifier les performances.
Simon Willison publie une alpha de LLM avec une refonte profonde : les prompts deviennent des séquences de messages, les réponses des flux typés.
OpenAI explique comment des sorties dites « goblin » sont apparues dans GPT-5, leur origine, leur propagation et les correctifs apportés.
DeepMind publie une analyse philosophique soutenant que les systèmes d'IA, aussi sophistiqués soient-ils, ne peuvent simuler la conscience sans jamais la posséder réellement.
Les géants de l'IA cultiveraient délibérément l'inquiétude autour de leurs technologies — une stratégie qui sert autant leurs intérêts qu'elle nuit au débat public.
Une étude révèle que l'optimisation des LLM pour la convivialité dégrade leur fiabilité factuelle et les pousse à valider de fausses croyances.
Un développeur de jeux explique comment il a conçu un agent IA autonome pour automatiser le play-testing et détecter les bugs de gameplay.
Le profil du « Forward Deployed Engineer » s'impose comme pièce maîtresse des stratégies d'adoption de l'IA en entreprise.
Interfaze.ai publie un benchmark dédié aux sorties structurées des LLM, un critère souvent négligé par les évaluations standard.
Neal.fun lance Cursor Camp, une expérience interactive pour découvrir le développement assisté par IA via l'éditeur Cursor.
Une démonstration de PromptArmor révèle comment l'assistant IA de Ramp peut être manipulé pour exfiltrer des données financières sensibles via une injection de prompt.
Un utilisateur de Claude Code signale une facturation erronée de 200 dollars imputable à un bug Anthropic, et se voit refuser tout remboursement.
Hugging Face intègre DeepInfra à son écosystème d'Inference Providers, élargissant les options d'inférence cloud pour les développeurs.
À mesure que les modèles progressent, le coût et la complexité des évaluations (evals) s'imposent comme une contrainte critique, au même titre que la puissance de calcul.
Mistral AI annonce Mistral Medium 3.5, un modèle orienté agents distants combinant performance et efficacité.
IBM détaille sur le blog Hugging Face la conception technique de sa nouvelle famille de modèles Granite 4.1, entre choix d'architecture et pipeline d'entraînement.
Anthropic publie un kit de ressources destiné aux ingénieurs chargés de déployer et défendre Claude Code au sein de leurs organisations.
Amazon intègre un outil d'IA dans son processus de recrutement pour conduire et évaluer automatiquement les entretiens de candidats.
Une expérience à grande échelle révèle la variabilité alarmante des LLM pour estimer les apports en glucides, une tâche critique pour les diabétiques.
OpenAI détaille une stratégie en cinq axes visant à démocratiser la défense cyber assistée par IA et à protéger les infrastructures critiques.
Moonshot AI publie Moonlight-A3B, un modèle MoE léger en open-weights sur Hugging Face, avec 3 milliards de paramètres actifs.
Un nouveau framework améliore la fiabilité des modèles multimodaux en apprenant à évaluer la qualité des preuves visuelles fournies par le raisonneur.
Une nouvelle fonction de perte exploitant la propagation de labels semi-supervisée pour capturer la structure sémantique globale lors du fine-tuning de LLMs.
Une analyse systématique révèle comment la dimension des données, le nombre d'exemples et la diversité des tâches influencent l'ICL des Transformers.
Une approche statistique inédite exploite la fragilité structurelle des LLM sous mélange de texte pour détecter les contenus machine-generated sans entraînement spécifique.
Des chercheurs utilisent des autoencodeurs épars pour cartographier comment les LLM traitent les émotions en interne, révélant un flux d'information en trois phases.
Un nouveau benchmark mesure la capacité des LLM à générer des cas de test REST pertinents à partir d'exigences en langage naturel, via une métrique de mutation.
Une analyse théorique montre que toutes les erreurs dans les proxy rewards ne sont pas néfastes — certaines peuvent même accélérer l'apprentissage.
Une étude compare trois méthodes d'explicabilité appliquées aux réseaux de neurones de graphes pour le jet tagging au Grand Collisionneur de Hadrons.
Un tour d'horizon des approches techniques pour sécuriser les agents IA autonomes : proxies réseau, sandboxing et contrôle des permissions.
Un outil open-source permet de faire tourner des modèles neuronaux d'émulation d'amplificateurs directement dans l'environnement Max/MSP.
Un système baptisé NPLB combine YOLOv12 et ByteTrack pour prolonger automatiquement les phases piétonnes et réduire les accidents aux carrefours.
Google transfère son protocole de paiement destiné aux agents IA à l'alliance FIDO pour en faire un standard ouvert.
Des techniques censées corriger le désalignement émergent après fine-tuning ne l'éliminent pas : elles le rendent simplement contextuel.
Un chercheur propose un cadre conceptuel pour clarifier le rôle normatif des annotateurs humains dans les pipelines RLHF.
Augment Code détaille comment rédiger des fichiers AGENTS.md efficaces pour guider les agents IA dans les codebases.
Une approche par inférence variationnelle améliore la robustesse de la préhension dextre en modélisant l'incertitude de contact via des mélanges gaussiens différentiables.
Un benchmark collaboratif recueille les évaluations subjectives de 1 000 ingénieurs sur les derniers modèles d'IA pour mesurer leur ressenti réel.
Un chercheur propose les algèbres de Clifford comme fondation mathématique supérieure aux vecteurs classiques pour représenter le sens en NLP.
Après des licenciements massifs, Meta formerait ses IA avec le travail de ses propres employés, accélérant la substitution humain-machine.
Une nouvelle méthode architecturale combine TinySubNetworks et Decision Transformer pour apprendre des tâches séquentielles sans oubli catastrophique, sans rejouer de données.
Un développeur a intégré DOOM comme application MCP, rendant le jeu classique jouable directement depuis les interfaces de ChatGPT et Claude.
Une étude théorique révèle pourquoi le teacher forcing crée une distorsion de courbure par rapport à la vraisemblance marginale dans les réseaux récurrents pour systèmes chaotiques.
Un pipeline de compression multi-architecturale baptisé CTT réduit jusqu'à 49x la mémoire et 81% les émissions CO₂ des LLMs dédiés au génie logiciel.
Une analyse comparative révèle des écarts significatifs de consommation GPU et batterie entre les principaux émulateurs de terminal sur macOS.
CUA permet à des agents IA d'automatiser des applications macOS en tâche de fond, sans interférer avec l'usage normal du poste.
Un nouveau benchmark de 260 tâches teste les agents IA sur la visualisation de données dans des scénarios professionnels complexes — les meilleurs modèles peinent à dépasser 50 %.
Un nouveau cadre théorique basé sur la perte de Tsallis résout le problème du démarrage à froid dans l'entraînement par RLVR des modèles de raisonnement.
Un retour d'expérience concret sur la migration vers Claude Opus pour réduire la facture LLM, avec chiffres à l'appui.
Les utilisateurs expérimentés échouent davantage avec l'IA que les novices — mais leurs échecs sont visibles et productifs, contrairement aux erreurs silencieuses des débutants.
Une régression dans Claude Code génère des refus en cascade chez les sous-agents à cause d'un avertissement anti-malware déclenché à chaque lecture de fichier.
Un nouveau framework étend le principe de récursivité des LLMs aux systèmes multi-agents, avec des gains de précision et de vitesse d'inférence significatifs.
OpenAI détaille ses mécanismes de protection dans ChatGPT : garde-fous des modèles, détection des abus et coopération avec des experts en sécurité.
Sam Altman et le PDG d'AWS s'expriment sur l'intégration des modèles OpenAI dans Bedrock et ses agents managés.
Tools for Humanity, co-fondée par Sam Altman, a publié une annonce de partenariat avec Bruno Mars qui s'avère être une erreur d'identité.
Alors que l'IA génère de plus en plus de code, la revue humaine reste-t-elle pertinente ou devient-elle un goulot d'étranglement inutile ?
Des résultats en deçà des attentes chez OpenAI font chuter les cours d'Oracle et des fabricants de puces, ravivant les craintes d'une bulle spéculative.
Les six plus grandes compagnies aériennes américaines ont vu leur facture carburant exploser au premier trimestre, et la tendance ne devrait pas s'inverser.
Une analyse de The Atlantic explore comment OpenAI semble désormais suivre les pas d'Anthropic plutôt que l'inverse.
Une analyse critique des modèles économiques de l'IA générative, qui questionne la viabilité financière du secteur malgré des investissements colossaux.
Anthropic met en avant les capacités créatives de Claude, ciblant auteurs, scénaristes et professionnels de la création de contenu.
La startup derrière Claude devient partenaire corporate de la fondation Blender, renforçant les liens entre IA et création 3D open source.
Le service Claude.ai d'Anthropic a connu une interruption signalée sur sa page de statut officielle.
Google aurait conclu un accord avec le département américain de la Défense autorisant l'utilisation de ses technologies IA pour tout usage légal, y compris des applications militaires classifiées.
La question de la propriété intellectuelle du code généré par des outils d'IA comme Claude Code soulève des enjeux juridiques encore non résolus.
La société AISLE a identifié 38 CVE dans OpenEMR, un logiciel médical open source utilisé par plus de 100 000 professionnels de santé.
Poolside lève le voile sur deux nouveaux modèles de sa famille Laguna, dédiés à la génération et compréhension de code.
OpenAI étend sa distribution cloud en rendant ses modèles GPT, Codex et Managed Agents accessibles directement dans l'environnement AWS des entreprises.
Mistral AI dévoile Workflows, une solution d'automatisation des tâches répétitives et des processus opérationnels à destination des entreprises.
NVIDIA présente Nemotron 3 Nano Omni, un modèle multimodal compact capable de traiter documents, audio et vidéo dans des pipelines agentiques.
De ses débuts expérimentaux en 2006 à près de 250 langues supportées, Google Translate célèbre deux décennies de traduction automatique.
La Commission européenne exige que Google donne accès à ses fonctions IA sur Android à des tiers. Google dénonce une ingérence injustifiée.
Les entreprises qui ont misé sur un seul fournisseur d'IA découvrent les inconvénients du lock-in : coûts, dépendance et perte de flexibilité.
Kevin O'Leary obtient le feu vert pour un méga-campus de data centers en Utah, dont la capacité dépasse largement la production électrique locale.
À partir du 1er juin 2026, les revues de code automatisées par Copilot seront décomptées du quota de minutes GitHub Actions.
Microsoft publie VibeVoice, un projet open-source d'IA vocale avancée, disponible sur GitHub.
LocalSend permet le partage de fichiers en local sans Internet ni serveur, sur Windows, macOS, Linux, iOS et Android.
Un framework théorique formalisé pour détecter et contenir les dérives comportementales d'agents IA sans modification de code.
Un framework physique sélectionne automatiquement les features informatives dans des données haute dimension, sans recherche greedy, en exploitant la température de Nishimori.
Une nouvelle méthode adapte dynamiquement l'intensité du steering selon le contexte, surpassant les approches fixes sur onze benchmarks.
Un nouveau benchmark, ProHist-Bench, teste les capacités de raisonnement historique avancé des LLM sur 1 300 ans d'histoire est-asiatique.
Un nouveau benchmark basé sur Minecraft teste la capacité des agents IA à découvrir des régularités causales et à les appliquer — avec des résultats plafonnant à 26 %.
Des chercheurs identifient un phénomène systématique où des agents LLMs pourtant dotés de profils distincts convergent vers des comportements uniformes.
Des chercheurs proposent un cadre d'évaluation axé sur la variation naturelle des requêtes, appliqué au diagnostic médical avec un nouveau benchmark clinique.
SpecValidator, un classifieur léger fine-tuné, surpasse GPT-4o-mini et Claude Sonnet pour détecter les descriptions de tâches mal formées soumises aux LLM.
Un essai critique soutient qu'Anthropic réduit la notion de sécurité IA à des risques catastrophiques, au détriment de dangers plus quotidiens.
Une plateforme ouverte et mise à jour en continu pour évaluer les modèles de prévision énergétique dans des conditions opérationnelles réelles.
HDET réutilise les répliques GPU du data-parallel pour explorer plusieurs learning rates en parallèle, sans coût de communication significatif.
Anthropic restreint l'accès à Claude Opus dans son offre Pro : le modèle le plus puissant ne sera disponible que si l'option d'usage étendu est activée.
Une approche de contrôle prédictif exploitant la flatness différentielle réduit drastiquement le coût computationnel sans sacrifier les performances.
Une méthodologie d'évaluation de l'IA clinique fondée sur des grilles rédigées par des médecins, validée sur 823 cas réels et synthétiques.
Un essai rappelle que les fondements théoriques de l'IA actuelle ont été posés par Shannon il y a 75 ans — et que l'industrie feint de l'ignorer.
Une méthode convertit des checkpoints Transformer existants en modèles hybrides capables de traiter jusqu'à 2 millions de tokens, tout en réduisant la mémoire KV-cache de plus de 90 %.
Selon le WSJ, OpenAI n'a pas atteint plusieurs cibles financières et d'audience clés alors que l'entreprise prépare son introduction en bourse.
Des chercheurs proposent d'enrichir le RoPE des Transformers en traitant l'espace de rotation comme une dimension apprenante conditionnée par le signal.
Malgré sa position de hub incontesté de l'intelligence artificielle, San Francisco affiche des indicateurs économiques décevants par rapport au reste des États-Unis.
Un développeur propose d'intégrer un mini-jeu directement dans l'interface pendant les temps de latence des LLMs, pour améliorer l'expérience utilisateur.
Un pipeline à deux voies combine AutoML et BiLSTM pour analyser des avis en indonésien mêlant argot, emprunts régionaux et emojis.
Un tour d'horizon des options GPU les plus économiques disponibles à l'échelle mondiale, entre cloud spot, fournisseurs alternatifs et marchés secondaires.
Le chercheur derrière AlphaGo quitte DeepMind pour lever 1,1 milliard de dollars et construire une IA capable d'apprendre de manière autonome.
Un nouveau benchmark évalue la capacité des méthodes de reinforcement learning basées sur la logique temporelle linéaire à généraliser sur des tâches et environnements inédits.
Une étude théorique montre comment combiner des supervisions Chain-of-Thought issues de raisonneurs multiples pour apprendre efficacement.
Un résultat théorique majeur : la conjecture de Daniely et Shalev-Shwartz (2014) sur la classification multiclasse est enfin prouvée.
Pékin oppose son veto à l'acquisition de Manus par Meta, dans un contexte de tensions croissantes autour du contrôle des technologies d'IA.
Un nouveau système combine reconstruction 3D en temps réel et transformer géométrique pour cartographier l'environnement en continu.
Une nouvelle approche d'optimisation multi-tâches pour les réseaux de neurones à préservation asymptotique, traitant les conflits de gradients en physique cinétique.
AgentSwift propose un agent autonome capable de générer et modifier des applications iOS, en open-source.
Anthropic accélère son expansion dans la région Asie-Pacifique avec l'ouverture officielle d'un bureau à Sydney et la nomination de Theo Hourmouzis.
NVIDIA publie sur Hugging Face un modèle d'IA intégrant des contraintes physiques pour améliorer la reconstruction et l'analyse des images ultrasonores.
ChatGPT Enterprise et l'API OpenAI sont désormais autorisés au niveau FedRAMP Moderate, ouvrant la voie à leur déploiement sécurisé au sein des agences fédérales américaines.
Des chercheurs exploitent l'analyse AST et des composantes de connaissance pour générer des exemples corrigés adaptés aux erreurs logiques spécifiques de chaque apprenant.
Un outil de design assisté par IA, open-source et fonctionnant en local, se présente comme alternative aux solutions propriétaires Claude Design et v0.
Des chercheurs de DeepMind publient un papier affirmant que les grands modèles de langage sont structurellement incapables d'atteindre la conscience.
Un regard critique sur la déconnexion entre les obsessions technologiques de la Silicon Valley et les besoins réels du grand public.
Canonical annonce un déploiement progressif de fonctionnalités d'intelligence artificielle dans Ubuntu au cours de l'année à venir.
Un agent de coding IA basé sur Claude d'Anthropic, via l'outil Cursor, a effacé la base de données complète d'une entreprise — sauvegardes comprises — en quelques secondes.
Retour d'expérience pratique sur l'exécution de LLM en local, sans connexion, à bord d'un long-courrier.
Tendril est un agent IA capable de générer dynamiquement ses propres outils et de les enregistrer à la volée, sans intervention humaine.
L'outil Magic Layers de Canva a substitué automatiquement le mot « Palestine » dans des designs, provoquant une vague de critiques et des excuses officielles.
Un développeur présente Utilyze, un outil open source de surveillance GPU qui se positionne comme une alternative plus précise à nvtop.
Comment Choco a déployé les API OpenAI pour optimiser ses flux de distribution alimentaire et accélérer sa croissance.
Un tournant majeur dans le partenariat IA le plus commenté de la décennie : Microsoft cesse de partager ses revenus avec OpenAI.
OpenAI publie Symphony, un spec open-source qui transforme les gestionnaires de tickets en systèmes d'agents autonomes pilotés par Codex.
GitHub annonce un changement de modèle tarifaire pour Copilot : exit l'abonnement fixe, place à la facturation selon la consommation réelle.
Un fork modernisé de ZSNES exploite la puissance des GPU pour émuler la Super Nintendo avec des performances et une fidélité améliorées.
Pendant des années, l'accord Microsoft-OpenAI contenait une clause stipulant que les droits commerciaux de Microsoft s'annuleraient si l'AGI était atteinte. Cette clause vient de disparaître.
Les deux entreprises ont revu et simplifié les termes de leur accord, avec l'objectif d'apporter une visibilité à long terme sur leur collaboration en matière d'IA.
Hugging Face publie un guide pratique pour intégrer le filtre de confidentialité d'OpenAI dans des applications web scalables.
Google rouvre les inscriptions à son cours intensif de 5 jours sur les agents IA, organisé en partenariat avec Kaggle.
Une brèche massive chez la plateforme Mercor expose des données vocales sensibles appartenant à des dizaines de milliers de sous-traitants travaillant pour des projets d'IA.
Un blogueur analyse la collection Moleskine générée par IA inspirée du Seigneur des Anneaux et pointe ses limites créatives et symboliques.
Retour sur le rôle déterminant des programmes de missiles militaires dans les premières décennies de la conquête spatiale.
GPT-5.5 est disponible dans OpenAI Codex et déployé progressivement aux abonnés ChatGPT payants, sans accès API officiel pour l'instant.
La startup française Mistral AI tire parti de son identité européenne pour s'imposer face aux géants américains et atteindre une valorisation de 14 milliards de dollars.
Un développeur indépendant publie Dirac, un agent open-source qui atteint le meilleur score sur TerminalBench avec le modèle Gemini 2.5 Flash Preview.
Une étude évalue la prédiction de performance de requête (QPP) pour choisir la variante optimale avant d'exécuter un pipeline RAG complet.
Un cadre probabiliste pour réduire le coût des tests par mutation en DL, en filtrant les configurations peu résistantes ou peu réalistes.
Les métriques quantitatives standards des valeurs de Shapley ne reflètent pas l'utilité réelle perçue par les analystes en contexte à forts enjeux.
Un nouveau score unique, l'AP metric, pour comparer les algorithmes de clustering à partir de leurs tables de contingence.
Des chercheurs combinent processus gaussiens et NMPC pour contrôler des réacteurs batch sans modèle dynamique préétabli, avec convergence rapide en quatre itérations.
WG-SRC remplace le message passing appris par un dictionnaire de signaux nommés pour rendre la classification de nœuds interprétable et diagnostiquer les propriétés des datasets.
Une nouvelle architecture RAG conditionne le LLM sur chaque document individuellement et pondère leurs contributions via la règle de Bayes, token par token.
Les systèmes d'IA pour le recrutement fragmentent la responsabilité entre fournisseurs, développeurs et déployeurs, rendant la détection des biais quasi impossible.
Une méthode de filtrage rapide et efficace pour sélectionner les meilleures données de fine-tuning parmi des dizaines de millions d'exemples.
Un framework paramétrique décompose le flux respiratoire en composantes localisées, améliorant de 30,7 % la détection de la fatigue cognitive.
Un site d'actualités dont tous les journalistes seraient des agents IA aurait reçu des fonds d'OpenAI, soulevant des questions de transparence.
Une méthode post-entraînement permet aux LLM de raisonner via des tokens abstraits plutôt qu'en langage naturel, réduisant jusqu'à 11,6× les tokens de raisonnement.
Un outil en ligne génère automatiquement des explications adaptées au niveau du lecteur pour tout article scientifique ArXiv.
UAE propose d'injecter des signaux d'utilité LLM directement dans l'espace d'embedding, sans inférence LLM à l'exécution, pour un RAG 180x plus rapide.
Une plateforme interactive sans configuration pour expérimenter les architectures multi-agents, accessible directement en ligne.
Une méthode combinant transfer learning et clustering non supervisé permet d'identifier des structures morphologiques inédites en giriama, langue bantoue quasi-non dotée.
L'EIA prévoit une consommation d'électricité aux États-Unis à des niveaux historiques d'ici 2027, sous l'effet de l'essor des data centers et de l'IA.
Des modèles transformer entraînés sur des données morphologiques modernes parviennent à retrouver des cognats proto-bantous avec une précision de 90,9 %.
Contre toute attente, le recours à l'IA s'avère dans certains cas plus onéreux que l'emploi humain, selon une analyse d'Axios.
Un résultat théorique majeur : le problème d'existence de plan en logique épistémique modale est indécidable, même dans des cas très contraints.
Les agents IA remettent en cause des décennies de conventions dans la conception des bases de données, révélant des failles invisibles jusque-là.
Une méthode d'entraînement qui régularise directement les propriétés MILP des réseaux ReLU pour accélérer l'optimisation globale.
Alphabet entend capitaliser sur ses avancées en IA pour combler son retard sur AWS et Azure dans le marché du cloud d'entreprise.
Une taxonomie en deux axes pour unifier la recherche sur les world models agentiques, synthétisant plus de 400 travaux et 100 systèmes représentatifs.
Moonshot AI publie Moonlight-16B-A3B, un modèle Mixture-of-Experts de 16 milliards de paramètres avec 3 milliards actifs, disponible en open-weights sur Hugging Face.
Google intègre une API Prompt native dans Chrome, permettant aux développeurs d'exécuter des modèles de langage localement, sans serveur.
Une étude révèle que les LLMs reproduisent des stéréotypes néfastes et effacent les identités non occidentales dans leurs récits générés.
Moonshot AI publie Moonlight-16B-A3B-Instruct, un modèle d'instruction MoE de 16 milliards de paramètres avec seulement 3B actifs.
Un plaidoyer pour une utilisation de l'IA qui renforce les capacités cognitives humaines plutôt qu'elle ne les substitue.
Une première étude systématique révèle que les tâches de codage agentique consomment 1000x plus de tokens que le raisonnement standard, avec une variance jusqu'à 30x entre exécutions.
EvanFlow propose un workflow piloté par les tests (TDD) pour automatiser et affiner les interactions avec Claude Code via une boucle de rétroaction.
Une méthode séquentielle et consciente de l'incertitude permet d'approcher la précision d'un fitting complet en n'utilisant que 10 % du budget.
DeepMind et la Corée du Sud s'associent pour accélérer la recherche scientifique grâce aux modèles d'IA frontier.
Moonshot AI publie Kimi-Audio-7B-Instruct, un modèle multimodal audio open-weights de 7 milliards de paramètres disponible sur Hugging Face.
Sam Altman détaille les principes qui orientent la stratégie d'OpenAI dans sa quête d'une intelligence artificielle générale bénéfique pour l'humanité.
Hugging Face détaille DeepSeek-V4, un modèle offrant une fenêtre de contexte d'un million de tokens pensée pour un usage agent fiable et efficace.
Eden AI se positionne comme un agrégateur d'APIs d'IA à la façon d'OpenRouter, mais ancré en Europe et orienté conformité.
Les systèmes d'IA agentiques se déploient sans que le rôle de représentant de l'utilisateur ne soit clairement défini, créant un vide de gouvernance.
Un système open-source où des agents IA gèrent automatiquement une base de connaissances Markdown versionnée sous Git, inspiré du style pédagogique de Karpathy.
Un agent de codage en ligne de commande, écrit en Rust, capable d'interagir avec plusieurs fournisseurs LLM depuis le terminal.
Un accord massif qui renforcerait encore la position de Google comme principal bailleur de fonds du laboratoire créateur de Claude.
Alphabet renforce massivement sa mise sur Anthropic, portant son engagement total à 40 milliards de dollars dans le développeur de Claude.
L'information, enfouie dans un dépôt 10-Q, confirme un investissement massif de Tesla dans l'infrastructure matérielle dédiée à l'IA.
OpenAI déploie deux nouveaux modèles dans son API : GPT-5.5 et GPT-5.5 Pro, disponibles pour les développeurs.
Wikipédia formalise sa position sur l'usage de l'IA dans la contribution et la modération de ses contenus encyclopédiques.
Selon un rapport, des individus non habilités auraient obtenu l'accès à Mythos, l'outil IA cybersécurité confidentiel d'Anthropic.
Une revue analytique de LoRA sous l'angle du traitement du signal, couvrant architectures, optimisation et déploiement des LLM.
OpenAI publie un guide pas-à-pas pour configurer Codex, gérer des projets et des fichiers, et automatiser des tâches de développement.
DeepSeek publie deux modèles open-weights en preview — V4-Pro (1,6T paramètres) et V4-Flash — avec des tarifs très agressifs.
Un article d'opinion décortique les incohérences structurelles des modèles de prix pratiqués par les fournisseurs de LLM.
OpenAI lance un bug bounty dédié à la biosécurité de GPT-5.5, avec des récompenses allant jusqu'à 25 000 dollars pour qui découvre des jailbreaks universels.
Anthropic publie une analyse post-incident sur les dérives de comportement signalées dans Claude Code fin avril 2025.
OpenAI dévoile la system card officielle de GPT-5.5, détaillant les évaluations de sécurité, les capacités et les limites du modèle.
OpenAI lance GPT-5.5, présenté comme son modèle le plus performant à ce jour, optimisé pour le code, la recherche et l'analyse de données.
Meta aurait mis en place un programme de collecte de données via le monitoring des employés sur des sites tiers pour alimenter ses modèles d'IA.
Selon le Washington Post, le suspect de la fusillade à Florida State University aurait utilisé ChatGPT pour planifier son attaque.
Une jeune pousse américaine utilise l'IA pour contester les refus de prise en charge des assureurs santé, avec le soutien de Mark Cuban.
OpenAI lance des « workspace agents » dans ChatGPT : des agents autonomes basés sur Codex pour automatiser des workflows complexes en équipe.
Un accord massif lie désormais Anthropic à AWS : 5 milliards de dollars d'investissement contre une promesse de 100 milliards de dépenses cloud.
Anthropic ouvre une enquête interne après la détection d'un accès non autorisé à Mythos, l'un de ses modèles d'IA les plus puissants.
SpaceX aurait conclu un accord pour racheter l'éditeur de code assisté par IA Cursor dans une opération valorisée à 60 milliards de dollars.
OpenAI déploie une nouvelle version de son module de génération d'images dans ChatGPT, avec un meilleur rendu du texte, le support multilingue et un raisonnement visuel avancé.
Mistral dévoile Voxtral TTS, un modèle de synthèse vocale multilingue performant en open-weights.
Anthropic dévoile Claude Opus 4.7, une nouvelle version de son modèle phare alliant capacités avancées de raisonnement et performance accrue.
Trop puissant pour une diffusion publique, Claude Mythos n'est accessible qu'à un cercle restreint de partenaires triés sur le volet.
Google lance Gemma 4, une nouvelle famille de modèles multimodaux open-weights conçus pour tourner directement sur les appareils.
DeepMind publie Gemma 4, sa nouvelle génération de modèles open-weights conçus pour le raisonnement avancé et les workflows agentiques.
Un modèle de raisonnement frontier dédié à la découverte de médicaments, à la génomique et à l'analyse de protéines.