Comment ça marche

Un pourcentage sans méthode derrière ne vaut rien. Cette page décrit la chaîne entière, de la donnée brute jusqu'au chiffre affiché sur une fiche, et ce qu'elle ne couvre pas.

D'où viennent les données

Nous travaillons avec un seul fournisseur de données commercial. Calendrier, scores, compositions, classements, statistiques, cotes : tout vient de là. Pas de collecte maison, pas de moissonnage de sites tiers. Cette dépendance unique est assumée, et c'est notre point de fragilité : quand notre source se trompe, nous nous trompons avec elle, faute d'un second avis pour la contredire.

La fraîcheur n'est pas la même partout, et c'est utile à savoir. Une page en direct redemande les scores en continu. La forme récente et les confrontations directes ne bougent pas pendant un match, donc elles ne sont pas redemandées sans arrêt. Une analyse d'avant-match, elle, est calculée une fois puis réutilisée : celle que vous lisez à midi pour un match du soir a été produite sans les compositions, et elle le restera jusqu'au calcul suivant.

Il manque régulièrement des choses, et la raison est rarement spectaculaire. Rassembler une journée de sport demande beaucoup de demandes séparées, chacune peut échouer, et sur une soirée chargée nous arbitrons ce que nous redemandons et ce que nous laissons. Des réponses reviennent vides aussi : un club de division inférieure n'a pas toujours d'historique de forme publié, auquel cas la section disparaît de la fiche plutôt que d'afficher une valeur fabriquée. Quand aucune position au classement ne nous parvient, le modèle est prévenu qu'elle n'est pas publiée au lieu de recevoir un chiffre par défaut, sans que nous sachions toujours si la compétition n'en tient pas ou si la donnée manque.

Plus gênant, un statut de match n'est pas une mesure prise sur la pelouse : c'est un champ que quelqu'un écrit, et il peut rester bloqué. Des rencontres restent marquées en direct longtemps après le coup de sifflet final, surtout dans les compétitions obscures, où plus personne ne surveille. Nous ne nous fions donc pas à l'étiquette et nous refermons ces matchs nous-mêmes au bout d'un certain temps. Le score reste parfois incomplet sur ces rencontres ; il l'était déjà.

Ce que le modèle calcule

Le football a droit à un traitement à part. Les autres sports reçoivent une analyse plus légère, construite sur moins d'entrées.

Pour un match de football, nous assemblons une fiche chiffrée : les cinq derniers résultats de chaque équipe, les buts marqués et encaissés sur ces rencontres, les matchs sans but encaissé, ceux à plus de 2,5 buts, chaque sortie récente avec sa date et son lieu, le bilan des confrontations directes, la position au classement, les cotes, et si le match a commencé, le score et les derniers événements.

Cette fiche part vers un modèle de langage. Elle est écrite en toutes lettres, si bien qu'un humain la lirait sans effort — et qu'un lecteur peut la reconstituer lui-même depuis la partie publique de la page. Sa consigne tient en deux idées : répondre dans un format fixe dont il ne peut pas sortir, et donner la priorité à la dynamique de la saison en cours plutôt qu'aux résultats anciens. Nous ne cherchons pas de créativité : deux lectures des mêmes données donnent le même chiffre. C'est une garantie de reproductibilité, et il ne faut pas la confondre avec une garantie de justesse.

Rien n'apprend de rien, au passage, et il vaut mieux l'écrire : aucune valeur de notre chaîne n'a jamais été ajustée en comparant une prédiction passée à un score. Le modèle ne voit jamais le résultat du match qu'il vient de lire.

Il en ressort une issue 1, N ou 2 avec sa probabilité, celle que les deux équipes marquent, celle de dépasser 1,5 puis 2,5 buts, celle de dépasser 9,5 corners, un niveau de confiance et une courte justification.

Quand cette lecture n'est pas disponible, une lecture de secours prend le relais. Elle est nettement plus fruste : un avantage de départ à l'équipe qui reçoit, puis l'écart de forme, l'écart de classement et les face-à-face. Nous la préférons à une case vide, et vous la reconnaissez à sa justification, qui commence par « Lecture de secours » — c'est écrit là exprès, pour que vous puissiez en tenir compte. Pendant un match, la lecture peut être recalculée au fil du score, un recalcul réservé au plan Pro.

Comment lire ce qui s'affiche

Une probabilité est une fréquence, pas un verdict. Quand la fiche annonce 68 % pour l'équipe à domicile, elle dit ceci : si cette configuration se répétait cent fois, cette équipe gagnerait environ soixante-huit fois. Les trente-deux autres ne sont pas une erreur du modèle : elles en font partie.

Un chiffre élevé n'est pas meilleur qu'un chiffre bas. 52 % sur un match serré est une information juste ; un modèle qui n'annoncerait jamais moins de 90 % serait soit extraordinaire soit cassé, et l'expérience dit lequel des deux.

Le niveau de confiance est un seuil, pas une note de qualité. Il dit à quel point les trois issues se séparent : élevé quand l'une se détache nettement des deux autres, faible quand les trois se tiennent. Il ne dit pas si le résultat annoncé tombera, et un niveau élevé sur une issue fausse est une combinaison parfaitement banale.

Un chiffre a aussi une date : une probabilité calculée plusieurs heures avant le coup d'envoi l'a été sans les compositions, et reste affichée ainsi jusqu'au calcul suivant.

Ce que le modèle ne sait pas faire

C'est la section la moins flatteuse, et la plus utile.

Les blessures, d'abord. Nous ne recevons aucune liste de blessés et de suspendus, sur aucun match. Le champ prévu pour elle part vide vers le modèle, qui lit donc « aucun signalé » sur chaque match, y compris ceux où un titulaire est forfait depuis la veille. Ce n'est pas un détail d'implémentation : c'est un trou dans les entrées, et il change le résultat. Tant que nous n'avons pas de source fiable là-dessus, la seule chose honnête est de l'écrire ici.

Le contexte humain ensuite, qui n'est une donnée nulle part. Un entraîneur sur le départ, des primes impayées, un vestiaire fracturé, une équipe qui pense déjà à la coupe : rien de cela n'arrive jusqu'au calcul. Le modèle voit ce que la fiche chiffrée lui donne : des résultats, des moyennes de buts, un classement, des cotes.

La météo et l'état de la pelouse n'entrent pas davantage : un terrain gelé, une bourrasque de travers, le modèle les découvre au mieux à travers les statistiques, une fois le match commencé. La rotation lui échappe de même, les compositions arrivant souvent une heure avant le coup d'envoi.

Plus une compétition est petite, plus la lecture devient générique. Sans historique de forme exploitable, la fiche existe toujours mais ne repose presque sur rien.

Reste le modèle lui-même. Il est régulier, il n'est pas infaillible, et il peut se tromper de façon parfaitement cohérente. La page des statistiques affiche une précision courante : les prédictions récentes réellement émises, confrontées aux scores finaux. C'est tout ce que nous savons dire. Ce chiffre bouge et ne constitue pas une série : nous ne gardons pas de journal daté de ce que nous avions annoncé avant de connaître le résultat, une analyse plus récente remplace la précédente, et les anciennes ne sont pas conservées indéfiniment. Le jour où cette archive existera, on pourra lire un taux avec sa période et son échantillon. Pas avant.

Le statut de nos prédictions

Nos prédictions sont informatives. Elles ne sont pas des conseils de paris, et nous n'en donnons pas.

Rien sur ce site ne vous dit quoi faire de votre argent. Aucune mise conseillée, aucune sélection du jour. Un seul prix est affiché sur une fiche : la cote 1, N ou 2 telle que notre source de données la publie, à titre indicatif. À côté d'un nom de buteur ou de passeur, il n'y a qu'une probabilité en pourcentage. Une pastille « Cote ~2.40 » y figurait ; elle a été retirée, parce qu'elle n'ajoutait aucune information au pourcentage affiché juste à côté, et surtout parce qu'elle changeait la nature de ce qui était écrit : un pourcentage est une estimation, un prix est une offre, et nous n'en faisons aucune. Nous ne garantissons aucun résultat et ne promettons aucun gain.

Si vous pariez, la décision est la vôtre, elle se prend ailleurs, sous votre responsabilité, et la réglementation de votre pays s'applique. Une probabilité de 68 % veut aussi dire qu'on se trompe à peu près une fois sur trois.

Nous préférons perdre le lecteur venu chercher un tuyau plutôt que de le laisser croire qu'il en a trouvé un.