MathPredictions

Zo werken onze voorspellingen

Elk cijfer op deze site komt uit één verwerkingsketen die voor elke wedstrijd op dezelfde manier draait. Geen redacteur kiest de wedstrijden, geen mens overschrijft een kans, en niets wordt stilletjes teruggetrokken nadat het verloren is.

In het kort: aanvals- en verdedigingsratings, gewogen naar hoe recent een wedstrijd is, worden geschat op meerdere seizoenen resultaten, omgezet in een volledige verdeling over alle mogelijke eindstanden, getoetst aan wat de wedmarkt inprijst en ten slotte in het openbaar afgerekend tegen de echte uitslag. De onderstaande secties behandelen elk van die stappen.

De data eronder

Het model wordt geschat op meerdere seizoenen afgelopen wedstrijden in alle competities die hier worden gedekt: eind- en ruststanden, gewonnen en weggegeven corners, plus de schoten en het balbezit die de datafeed levert en die de contextpanelen op de pagina en de terugvalketen van het cornermodel voeden. Daarnaast staat een momentopname van de bookmakerquoteringen, vastgelegd zodra een voorspelling wordt gegenereerd en bijgewerkt zolang de wedstrijd nog open is. Esports en virtuele of gesimuleerde competities worden uitgesloten via een handmatig onderhouden register en niet via naamherkenning, zodat hun uitslagen de rating van een echt team nooit kunnen vervuilen.

In de tijd gewogen aanvals- en verdedigingsratings

Elk team draagt een aanvalsrating en een verdedigingsrating: hoeveel het creëert en hoeveel het weggeeft ten opzichte van zijn eigen omgeving. Beide worden samen geschat met iteratieve proportionele aanpassing, een oplosser in gesloten vorm die afwisselt tussen aanval en verdediging totdat de hele groep het aantal doelpunten reproduceert dat er werkelijk in is waargenomen, waarbij elke historische wedstrijd wordt afgewaardeerd met een exponentiële recentheidskern. Recente vorm domineert en oudere seizoenen vervagen geleidelijk in plaats van bij een willekeurige seizoensgrens te worden afgekapt. De schatting gebeurt binnen groepen per land, die de divisies van een land samen met de nationale bekertoernooien bevatten: bekerduels vormen zo bruggen tussen divisies, en een promovendus begint met een rating die tegen echte tegenstanders is verdiend in plaats van met een blanco blad.

Omgaan met weinig historie

Ruwe ratings reageren te sterk op kleine steekproeven, dus wordt elke rating naar de referentiewaarde van zijn groep getrokken in verhouding tot het bewijs dat eronder ligt — een empirisch-bayesiaanse stap die voorkomt dat een club met een handvol geregistreerde wedstrijden onverslaanbaar lijkt omdat er twee met 4-0 werden gewonnen. De basiswaarden van competities krijgen dezelfde behandeling richting het groepsgemiddelde, wat voorkomt dat een kleine competitie binnen een grote groep op ruis wegdrijft. De sterkte van die trek hangt af van de effectieve steekproefomvang en niet van het aantal wedstrijden, zodat sterk afgewaardeerde oude duels terecht minder zwaar wegen.

Van ratings naar een verdeling over eindstanden

Voor elke wedstrijd leveren de ratings van beide teams en de thuis- en uitbasiswaarden van de competitie een verwacht aantal doelpunten per kant op. Die verwachtingen worden uitgevouwen tot een volledige kansmatrix over eindstanden — elke plausibele uitslag vanaf 0-0 — met de Dixon-Coles-correctie voor de goed gedocumenteerde afhankelijkheid tussen beide scores in doelpuntarme wedstrijden, precies waar onafhankelijke Poisson-modellen de fout in gaan en precies waar voetbal zich afspeelt. Wedstrijduitslag, juiste eindstand, over/under, beide teams scoren, dubbele kans en Aziatische handicap worden allemaal van diezelfde genormaliseerde matrix afgelezen. Twee markten die wij publiceren kunnen elkaar dus niet tegenspreken: de over/under-quotering en de quotering voor de juiste eindstand zijn dezelfde verdeling, twee keer bekeken.

De markt goed lezen

Waar bookmakerquoteringen bestaan, worden ze niet voor waar aangenomen. Gepubliceerde quoteringen bevatten de marge van de bookmaker, dus die marge wordt er eerst uit gehaald en de quoteringen worden omgezet in eerlijke kansen. Handicap- en totaallijnen worden vervolgens als stelsel opgelost naar de twee grootheden die de markt werkelijk uitdrukt — het krachtsverschil tussen de ploegen en het verwachte doelpuntentotaal —, een veel stabieler signaal dan welke losse quotering ook. Kwartlijnen worden geprijsd via een kern met gesplitste inzet die de halve-winst- en halve-verliesgevallen exact behandelt, in plaats van ze af te ronden naar de dichtstbijzijnde hele lijn, zoals de meeste gepubliceerde modellen stilzwijgend doen.

Een speciaal cornermodel

Corners worden niet uit doelpunten afgeleid. Ze krijgen eigen aanvals- en verdedigingsratings — gewonnen en weggegeven corners, geschat met dezelfde in de tijd gewogen oplosser —, worden per ploeg geprojecteerd en vervolgens tegen de exacte cornerlijn van de wedstrijd geprijsd met een gediscretiseerde continue verdeling in plaats van een opzoektabel. Is de cornerhistorie van een team te dun om op te vertrouwen, dan valt het model terug via een vastgelegde keten: eerst de ratings, dan de live wedstrijdstatistieken, dan alleen de markt. Haalt geen van die niveaus de drempel, dan meldt het model dat er geen data zijn in plaats van een getal te verzinnen.

Combineren op basis van precisie

Model en markt worden gecombineerd via precisieweging op de effectieve steekproefomvang: bij teams met weinig historie ligt het meeste gewicht bij de markt, in diep gedekte competities bij het model, en de overgang verloopt vloeiend in plaats van als een schakelaar. Blijft er na die combinatie een waardeverschil van 5% of meer over, dan wordt de tip als value gemarkeerd — het model claimt een voordeel dat de quotering niet weerspiegelt, en zegt dat openbaar vóór de aftrap, waar het achteraf te controleren is.

Kalibratie en toetsing buiten de steekproef

Niets gaat live op basis van een fraai ogende backtest. Het model wordt gevalideerd op ongeveer een half miljoen historische wedstrijden met strikte scheiding buiten de steekproef: ratings worden alleen geschat op wat vóór elke aftrap bekend kon zijn, en uitkomsten worden beoordeeld met log-loss en Brier-score — eigenlijke scoringsregels die zelfverzekerde misslagen bestraffen in plaats van belonen — samen met het trefpercentage tegen de lijn en gebinde kalibratiecurves die controleren of een voorspelling van 60% ook echt ongeveer 60% van de tijd uitkomt. Een versie die haar acceptatiedrempels niet haalt, gaat niet live.

Geen handmatige selectie

Elke in aanmerking komende echte voetbalwedstrijd krijgt een voorspelling — geen krenten uit de pap. Voorspellingen worden 30 minuten voor de aftrap bevroren, en elke bevroren tip wordt afgerekend tegen de einduitslag en meegeteld in het openbare trefzekerheidsoverzicht, winst en verlies allebei.