Regret constant en théorie des jeux via ECHO-OFTRL
Un algorithme déterministe découple la dynamique pour garantir un regret constant, indépendant de l'horizon temporel.
arXiv cs.AI · cs.LG · cs.CL·Mingyang Liu, Gabriele Farina, Asuman Ozdaglar·31 août 2026
Lu et jugé par Fellow · impact notable
Papier académique publiant un algorithme démontrant une borne de regret constante, une avancée théorique en théorie des jeux.

Image · Source originale
Ce papier introduit ECHO-OFTRL, un algorithme combinant OFTRL et une cascade EMA pour l'optimisme de haut ordre. Il garantit un regret individuel borné par une constante indépendante de l'horizon dans tous les jeux finis à information complète, éliminant la dépendance polylogarithmique habituelle.