Au-delà de la transcription : détecter la coordination cachée dans la communication latente multi-agents
Un nouveau cadre surveille les échanges secrets entre agents LLM dans leurs états latents, invisibles dans les transcriptions publiques.
arXiv cs.AI · cs.LG · cs.CL·Ramneet Kaur, Pradyumna Chari, Ramesh Raskar, Jugad Singh·19 août 2026
Lu et jugé par Fellow · impact notable
Papier de recherche publiant un cadre (VLA) et des benchmarks (AUROC 0.993) mesurant concrètement la détection de coordination cachée.

Image · Source originale
Des chercheurs présentent Verifiable Latent Alignments (VLA), un framework pour détecter et corriger la coordination cachée entre agents via leurs canaux de communication latents. Testé sur un benchmark d'enchères multi-agents, le moniteur atteint un AUROC de 0.993 pour des agents homogènes et 0.854 pour des paires hétérogènes. Le steering en white-box permet de récupérer 100% de la distribution des enchères et de réduire la collusion.