Jak fungují naše předpovědi
Každé číslo na těchto stránkách je výstupem jediného procesu, který běží pro každý zápas stejně. Žádný redaktor nevybírá zápasy, žádný člověk nepřepisuje pravděpodobnost a nic se po prohře tiše nestahuje.
Ve zkratce: hodnocení útoku a obrany vážené podle stáří zápasů se odhaduje z několika sezon výsledků, převádí se na úplné rozdělení možných výsledků, porovnává se s tím, co oceňuje sázkový trh, a nakonec se veřejně vyhodnocuje proti skutečnému výsledku. Následující oddíly popisují každý z těchto kroků.
Data v základu
Model se odhaduje na několika sezonách odehraných zápasů ve všech zde pokrytých soutěžích: konečné a poločasové výsledky, získané a inkasované rohy a dále střely a držení míče, které přináší datový zdroj a které pohánějí kontextové panely na stránkách i záložní řetězec modelu rohů. Vedle toho stojí snímek kurzů sázkových kanceláří, pořízený ve chvíli generování předpovědi a obnovovaný, dokud zápas ještě nezačal. Esport a virtuální či simulované soutěže jsou vyloučeny prostřednictvím ručně udržovaného rejstříku, nikoli podle shody názvů, takže jejich výsledky nikdy nemohou znečistit hodnocení skutečného týmu.
Časově vážené hodnocení útoku a obrany
Každý tým nese hodnocení útoku a hodnocení obrany — kolik vytvoří a kolik dovolí vzhledem ke svému prostředí. Obojí se odhaduje společně iterativním proporcionálním vyrovnáváním, řešičem v uzavřeném tvaru, který střídá útok a obranu, dokud celý soubor nereprodukuje gólovou produkci v něm skutečně pozorovanou, přičemž každý historický zápas je diskontován exponenciálním jádrem aktuálnosti. Nedávná forma převažuje a starší sezony pozvolna slábnou, místo aby byly uťaty na libovolné hranici sezony. Odhad probíhá uvnitř souborů po zemích, které drží pohromadě soutěže dané země i její domácí poháry: pohárové dvojice tak tvoří mosty mezi úrovněmi a nováček přichází s hodnocením získaným proti skutečným soupeřům, nikoli s prázdným listem.
Když je dat málo
Surová hodnocení příliš reagují na malé vzorky, a proto je každé z nich taženo k referenční hodnotě svého souboru úměrně důkazům, které za ním stojí — empiricko-bayesovský krok, který zabrání tomu, aby klub s hrstkou zaznamenaných zápasů vypadal jako neporazitelný jen proto, že dva z nich skončily 4:0. Základní hodnoty soutěží procházejí stejným ošetřením směrem k průměru souboru, což brání tomu, aby malá soutěž uvnitř velkého souboru ujížděla po šumu. Síla tohoto tahu závisí na efektivní velikosti vzorku, nikoli na počtu zápasů, takže silně diskontované staré zápasy právem váží méně.
Od hodnocení k rozdělení výsledků
Pro každý zápas dávají hodnocení obou týmů a domácí i venkovní základní hodnoty soutěže očekávaný počet gólů pro každou stranu. Tato očekávání se rozvinou do úplné mřížky pravděpodobností výsledků — každý věrohodný výsledek od 0:0 výše — s Dixon-Colesovou korekcí na dobře zdokumentovanou závislost mezi oběma skóre v zápasech s málo góly, tedy přesně tam, kde se nezávislé Poissonovy modely mýlí a kde fotbal skutečně žije. Výsledek zápasu, přesný výsledek, počet gólů nad/pod, oba týmy skórují, dvojitá šance i asijský handicap se čtou z jedné a téže normalizované mřížky. Dva trhy, které zveřejňujeme, si proto nemohou odporovat: kurz na nad/pod a kurz na přesný výsledek jsou totéž rozdělení, jen viděné dvakrát.
Jak správně číst trh
Tam, kde kurzy sázkových kanceláří existují, se neberou za bernou minci. Zveřejněné kurzy obsahují marži sázkové kanceláře, proto se z nich marže nejprve odečte a kurzy se převedou na férové pravděpodobnosti. Handicapové a totalové linie se pak řeší jako soustava pro dvě veličiny, které trh ve skutečnosti vyjadřuje — převahu jednoho týmu nad druhým a očekávaný počet gólů —, což je mnohem stabilnější signál než jakýkoli jednotlivý kurz. Čtvrtinové linie se oceňují jádrem s děleným vkladem, které přesně ošetřuje případy poloviční výhry a poloviční prohry, místo zaokrouhlení na nejbližší celou linii, jak to většina publikovaných modelů tiše dělá.
Samostatný model rohů
Rohy se neodvozují z gólů. Mají vlastní hodnocení útoku a obrany — získané a inkasované rohy, odhadované týmž časově váženým řešičem —, promítají se pro každou stranu zvlášť a poté se oceňují proti přesné rohové linii zápasu pomocí diskretizovaného spojitého rozdělení, nikoli vyhledávací tabulkou. Když je rohová historie týmu příliš chudá, model sestupuje po definovaném řetězci: nejprve hodnocení, pak živé statistiky zápasu, pak samotný trh. Pokud žádná z těchto úrovní nepřekročí práh, model uvede, že data nejsou, místo aby si číslo vymyslel.
Spojení vážené přesností
Model a trh se spojují vážením podle přesnosti založeným na efektivní velikosti vzorku: u týmů s chudou historií nese většinu váhy trh, v hluboce pokrytých soutěžích model, a přechod mezi nimi je plynulý, nikoli přepínač. Pokud po tomto spojení přetrvá hodnotový rozdíl 5 % nebo více, je tip označen jako value — model tvrdí, že má výhodu, kterou kurz neodráží, a říká to veřejně před výkopem, kde to lze později ověřit.
Kalibrace a testy mimo vzorek
Nic nejde do provozu proto, že backtest hezky vypadá. Model je validován na zhruba půl milionu historických zápasů s přísným oddělením mimo vzorek: hodnocení se odhaduje jen z toho, co bylo možné vědět před daným výkopem, a výsledky se hodnotí log-loss a Brierovým skóre — vlastními bodovacími pravidly, která trestají sebejistý omyl, místo aby ho odměňovala — spolu s úspěšností proti linii a kalibračními křivkami po pásmech, které ověřují, zda tip s pravděpodobností 60 % skutečně vychází zhruba v 60 % případů. Verze, která nedosáhne akceptačních prahů, do provozu nejde.
Bez ručního výběru
Každý způsobilý zápas skutečného fotbalu dostane předpověď — žádné vybírání těch snadných. Předpovědi se zmrazují 30 minut před výkopem a každý zmrazený tip se vyhodnotí proti konečnému výsledku a započítá do veřejné bilance úspěšnosti, výhry i prohry stejně.