Flag Game : un modèle jouet pour l'interprétabilité mécaniste des essaims d'agents IA
Une expérience minimaliste révèle comment des agents IA forment des croyances collectives, jusqu'à la polarisation à grande échelle.
arXiv cs.AI · cs.LG · cs.CL·Elizabeth Pavlova, Hidenori Tanaka·16 septembre 2026
Lu et jugé par Fellow · impact léger
Article de recherche académique proposant un modèle jouet théorique sans implémentation ou API disponible.

Image · Source originale
Les chercheurs introduisent le Flag Game, un modèle jouet où des agents observent des fragments partiels d'un drapeau caché et échangent leurs croyances. L'étude montre une évolution non monotone des performances selon la taille de la population, avec un effondrement collectif des croyances à petite échelle qui se transforme en polarisation à grande échelle. Une technique d'attribution de circuit social permet d'identifier quels agents influencent le plus la dynamique collective, vérifiée par interventions causales.