Toutes les news taguées avec ce sujet.
Un billet technique détaille comment créer des plugins Rust pour ajouter des fonctions personnalisées performantes à la bibliothèque Polars.
NVIDIA optimise le transfert des checkpoints massifs pour réduire la latence et les coûts réseau dans les clusters.
Un projet open source promet d'accélérer drastiquement le processus de tokenisation utilisé par les LLM, une étape souvent négligée mais coûteuse en performance.
Un nouveau tokenizer baptisé Gigatoken promet des performances de traitement inédites, selon un thread partagé sur X.
Un article technique explore comment l'interning de chaînes via arènes denses accélère significativement les compilateurs modernes.
Une implémentation GPU accélère massivement les conversions de couleurs en JavaScript via WebGPU.
Un retour d'expérience sur les limites des mécanismes de verrouillage de PostgreSQL face à la montée en charge.
OpenAI dévoile GPT-5.6, un modèle promettant plus d'intelligence par token et un meilleur rapport performance-prix.
Un cas réel d'échec de chargement GML révèle pourquoi les tuiles vectorielles s'imposent pour les grands jeux de données géospatiales.
Un benchmark comparatif montre que les GPU AMD offrent désormais une alternative sérieuse aux puces NVIDIA pour l'inférence de modèles LLM à moindre coût.
Une audit de GSO, SWE-Perf et SWE-fficiency révèle des fragilités majeures : instabilité des runtimes, règles de scoring biaisées et saturation des tâches.
Un développeur indépendant a intégré un pipeline de rendu GPU à l'éditeur Emacs, explorant les limites du moteur d'affichage historique.
Une analyse critique des pratiques de benchmarking dans l'industrie des bases de données, entre biais méthodologiques et marketing trompeur.