Solutions · Secteurs
Recherche & enseignement
Des jeux de données et des modèles documentés, pour travailler dessus.
Le football produit des séries longues, propres et publiques — un terrain rare pour enseigner la modélisation statistique ou l'éprouver. Mais partir de zéro sur la collecte et le nettoyage prend un temps qu'un cours ou un projet n'a pas toujours.
Ce que nous fournissons
Les résultats depuis 2019 sur six championnats, les forces d'attaque et de défense estimées par saison, et les probabilités que le modèle a réellement publiées à chaque journée. Ce dernier point est le plus utile et le plus rare : disposer des prédictions telles qu'elles étaient au moment où elles ont été faites, et non recalculées après coup, est la seule façon d'évaluer honnêtement un modèle.
Pour l’enseignement
Les modèles employés — Maher (1982), Dixon-Coles (1997) — sont publiés et se réimplémentent en un TP. Notre page méthodologie décrit la chaîne complète : estimation sous contrainte, pondération temporelle calibrée, validation temporelle, propagation de l'incertitude par rééchantillonnage. De quoi bâtir un cours sans repartir de zéro.
Nos conditions
Gratuit pour un usage académique ou pédagogique, sur simple demande motivée. Nous demandons seulement d'être cités, et d'avoir accès au travail publié — c'est ainsi que nous apprenons où notre modèle se trompe.
Pourquoi nous
Nous utilisons nous-mêmes ce que nous mettons à disposition. Ce ne sont pas des données publiées puis abandonnées : c'est notre outil de travail quotidien, et il est corrigé quand il se révèle faux.
Quelques exemples concrets
- Résultats de six championnats depuis avril 2019
- Forces estimées par équipe et par saison
- Les probabilités publiées à chaque journée, non recalculées