SpeakerMem-R1 : une mémoire à double piste centrée sur les locuteurs pour le dialogue multi-participants
Un nouveau système de mémoire conversationnelle distingue qui dit quoi et à qui, pour mieux gérer les échanges à plusieurs.
arXiv cs.AI · cs.LG · cs.CL·Haobo Zheng, Tan Tang, Yan Chen, Weijie Wang·22 septembre 2026
Lu et jugé par Fellow · impact notable
Nouvelle architecture de mémoire conversationnelle (SpeakerMem-R1) avec résultats SOTA vérifiables sur plusieurs benchmarks publics de dialogue multi-participants.

Image · Source originale
SpeakerMem-R1 propose une mémoire à double piste combinant messages verbatim attribués aux locuteurs et états dérivés à l'échelle individuelle et collective. Le modèle Writer-R1, entraîné avec SpeakerLevenshtein et un GRPO conditionné par locuteur, réduit les erreurs d'attribution et de mise à jour. Il obtient des résultats supérieurs à l'état de l'art sur GroupMemBench, SocialMemBench, EverMemBench et LoCoMo.