Docteur Bet

Méthodologie

Le modèle joueurs

Dixon-Coles ne lit pas les compositions. Un second modèle estime ce que vaut chaque joueur à une date donnée, et ce que son absence coûte réellement à son équipe.

Pourquoi un second regard

Le modèle de championnat décrit une équipe par deux nombres, estimés sur ses résultats. C'est suffisant pour rejouer une saison, et insuffisant pour lire un match précis : il ne sait pas qui joue. Une équipe privée de son meilleur ailier garde sa force d'attaque jusqu'à ce que les résultats la démentent — plusieurs semaines plus tard.

Le modèle joueurs répond à la question que l'autre ne peut pas poser : que vaut cette équipe ce soir, avec ces onze-là ?

Ce qu'il mesure

Il attribue à chaque joueur un niveau sur un ensemble de gestes du jeu — ce qu'il produit offensivement, ce qu'il détruit, ce qu'il sécurise — séparément de l'équipe dans laquelle il évolue. Un milieu excellent dans une équipe faible et un milieu moyen dans une équipe forte produisent les mêmes statistiques brutes ; l'intérêt du modèle est précisément de les séparer.

Ces niveaux sont ensuite agrégés au niveau du onze annoncé, et convertis en intensités offensive et défensive comparables à celles du modèle de championnat.

Ce qu'il permet : retirer un joueur

C'est l'usage qui distingue ce modèle du premier. On peut reconstruire le onze sans un joueur, le remplacer par celui qui jouerait réellement à sa place — pas par un remplaçant théorique, mais par le suppléant que les compositions récentes désignent, et qui n'est ni blessé ni suspendu — puis recalculer la distribution complète des scores.

La sortie n'est donc pas « ce joueur est important », mais un écart mesuré : tant de points de probabilité de victoire, tant de buts attendus, un déplacement chiffré de la loi des scores.

Comment nous le vérifions

Sur des rencontres que le modèle n'a jamais vues pendant son ajustement, et en comparant ses probabilités à ce qui s'est réellement produit. C'est le même critère que partout ailleurs sur ce site : la vraisemblance de ce qui est arrivé, pas l'impression que donne une prédiction après coup.

Ce modèle est aussi tenu de battre un témoin. Un écart qui ne survit pas au changement de période de test n'est pas un résultat : c'est du bruit, et nous le traitons comme tel.

Ce qu'il ne sait pas

Il part des compositions annoncées. Une heure avant le coup d'envoi, il n'a rien à dire de plus que le modèle de championnat.

Il ne lit ni la tactique, ni le plan de match, ni l'état de forme du jour. Un joueur replacé à un poste qu'il n'occupe jamais est mal évalué, parce qu'il l'est à partir de ce qu'il a produit ailleurs.

Et sa couverture suit celle de nos données. Sur une rencontre internationale, une partie des joueurs n'a pas d'historique exploitable dans nos championnats : nous ne publions alors rien plutôt que de combler le trou par une moyenne.

Ce que nous ne détaillons pas

La liste des gestes retenus, la façon dont les niveaux individuels sont estimés et la manière dont ils se recomposent en force d'équipe restent internes. Ce n'est pas une coquetterie : c'est le travail qui distingue nos produits, et il serait reproductible en l'écrivant.

Ce qui reste vérifiable, en revanche, est ce qui compte pour un lecteur : la méthode d'évaluation, les limites ci-dessus, et l'historique des résultats.

Le modèle de championnat, lui, est décrit en entier — il est publié depuis 1997 et nous n'y avons rien inventé. Lire la méthodologie complète.

Aller plus loin

Nous avons un modèle qui lève ces limites

Le modèle publié ici est ouvert, documenté, et volontairement simple — il doit pouvoir être reproduit. Celui que nous utilisons en interne va plus loin : il lève l’hypothèse d’indépendance entre les deux équipes au lieu de la corriger sur quatre scores, il intègre les cotes du marché, et il est entraîné marché par marché. Il n’est pas publié ici, mais il est accessible.