Toutes les news taguées avec ce sujet.
Les chercheurs réexaminent la dualité bayésienne d'Amari et la lient à la dualité convexe de la règle de Bayes.
Un framework transforme les historiques d'exécution d'agents en environnements reproductibles pour générer des tâches synthétiques et améliorer le post-training.
Un fil Hacker News dénonce l'afflux de contributions jugées de faible qualité, probablement produites avec l'aide de l'IA générative.
Une méthode d'apprentissage sans étiquettes qui combine distillation et RL pour améliorer le raisonnement mathématique.
Un système de recherche documentaire académique borné et inspectable surpasse les agents de deep research propriétaires, à un tiers du coût.
Une nouvelle méthode TTT par blocs concilie expressivité dynamique et parallélisation matériel, tout en améliorant l'extrapolation de longueur.
Une méthode de diffusion masquée avec discrétisation stochastique améliore la robustesse de l'imputation.
Un nouveau framework scalable qui combine attention parcimonieuse et apprentissage de représentation pour exceller dans la régression sur données tabulaires complexes.
Une étude démontre qu'un seul qubit couplé à un capteur classique réduit exponentiellement les mesures nécessaires.
Cette méthode sans entraînement accélère les LLM via des arbres de candidats parallèles, dépassant les vitesses des approches classiques.
Une extension des Logic Tensor Networks intégrant les dimensions structurelles comme citoyennes de premier ordre.
Une analogie exacte de la règle de Born pour l'attention softmax sur le simplexe probabiliste.
FinATOM utilise la génération de tokens contrainte pour unifier prévisions de rendement et allocation d'actifs.
Une méthode améliore l'adaptation des agents LLM via un diagnostic en boucle fermée et un raffinement proximal.
Un framework agentic surpasse les algorithmes conventionnels pour concevoir des synthèses de produits naturels complexes.
Une collection de 50 générateurs pour l'entraînement supervisé par complétion, améliorant les performances sur DROP et ARC-Challenge.