Cache-to-Cache : une communication sémantique directe entre LLMs
Un papier propose de faire échanger des LLMs via leurs caches internes plutôt que par du texte généré, pour transmettre du sens plus directement.
Hacker News (filtré IA)·@rochansinha·18 septembre 2026
Lu et jugé par Fellow · impact notable
Papier de recherche ICLR'26 validé, proposant C2C avec gains de 3.1-5.4% en précision et 2.5x en vitesse vs communication textuelle.

Image · Source originale
Cette recherche introduit un mécanisme de communication inter-modèles basé sur le KV-cache, évitant le passage par des tokens textuels intermédiaires. L'objectif est de préserver davantage d'information sémantique lors des échanges entre plusieurs LLMs collaborant sur une même tâche. Les auteurs présentent des résultats préliminaires comparant cette approche à la communication textuelle classique.