Comparaison du système
Elo contre Glicko
Elo et Glicko sont les deux systèmes de notation les plus importants aux échecs compétitifs, mais ils résolvent le problème de mesure différemment. L'Elo traditionnel vous donne un nombre unique représentant la force estimée. Glicko vous donne ce chiffre plus un écart de notation (RD) qui mesure explicitement le degré de confiance du système dans l'estimation. Cette différence fondamentale explique pourquoi votre classement FIDE et votre classement Chess.com se comportent si différemment, même lorsque vous jouez au même niveau.
Elo : un chiffre, aucun intervalle de confiance
Le système Elo classique attribue à chaque joueur un numéro de classement unique. Lorsque vous jouez à un jeu, le système compare le résultat au score attendu et ajuste la note. Le facteur K contrôle la vitesse à laquelle le nombre évolue. Il n’existe aucun mécanisme intégré permettant d’exprimer des doutes sur la note : un joueur noté à 1 500 après 500 parties est identique à un joueur noté à 1 500 après 5 parties. Pour comparer les différences côte à côte, consultez Pourquoi les notes des échecs diffèrent.
Cette simplicité est la plus grande force d'Elo et sa plus grande limitation. Le nombre est facile à comprendre et à communiquer, mais il ne peut pas vous dire si le système a un niveau de confiance élevé ou s'il est encore en train de deviner. Pour comparer les différences côte à côte, consultez Notes FIDE et États-Unis sur les échecs.
Glicko : Notation + Écart de Notation + Volatilité
Glicko (et son successeur Glicko-2, utilisé par Lichess et Chess.com) suit trois valeurs pour chaque joueur : la note, l'écart de note (RD) et la volatilité de la note. Le RD commence à un niveau élevé pour les nouveaux joueurs et diminue à mesure que de nouvelles parties sont jouées. Si un joueur arrête de jouer, le RD augmente progressivement à nouveau, reflétant une incertitude croissante quant à sa force actuelle.
Cela signifie que Glicko peut réagir de manière plus agressive aux résultats de joueurs incertains et de manière plus conservatrice aux résultats de joueurs bien établis – automatiquement, sans avoir besoin de bandes de facteur K fixes. Un joueur qui revient et qui est inactif depuis des mois verra des fluctuations plus importantes qu'un joueur actif ayant le même classement, car le système est moins sûr du niveau du joueur inactif.
Différences pratiques que vous remarquerez
- Après une pause : Dans Elo, votre premier match retour se comporte de la même manière que votre dernier match avant la pause. Dans Glicko, le système augmente votre RD pendant l'inactivité, de sorte que vos premières parties produisent des variations de note plus importantes.
- Volatilité des nouveaux comptes : les systèmes Glicko sont intentionnellement volatils pour les nouveaux comptes, convergeant rapidement. Elo avec K=40 obtient quelque chose de similaire mais avec moins d'élégance.
- Stabilité dans le temps : les joueurs Glicko actifs depuis longtemps ont un RD très faible, ce qui rend leurs notes extrêmement stables – souvent plus stables que celles d'Elo avec K=10.
- Comparaison inter-systèmes : une note Glicko de 1 500 avec RD=30 est une mesure très fiable. Une note Glicko de 1 500 avec RD=200 est essentiellement une supposition. Elo n'a aucun moyen d'exprimer cette distinction.
Pourquoi vous ne pouvez pas convertir entre eux
Les classements Elo et Glicko fonctionnent sur la même échelle générale (un avantage de 200 points produit des scores attendus similaires dans les deux systèmes), mais les populations, les mécanismes de mise à jour et la gestion de la confiance créent de réelles divergences pour les joueurs individuels.
Un joueur très actif sur Lichess (Glicko-2) et modérément actif dans les événements FIDE (Elo) développera naturellement des numéros différents dans chaque système. Ni l’un ni l’autre n’a tort : ils mesurent le même joueur sous différents angles contre différents adversaires avec différents outils mathématiques.