MathPredictions

Ako fungujú naše predpovede

Každé číslo na týchto stránkach je výstupom jediného procesu, ktorý beží pre každý zápas rovnako. Žiadny redaktor nevyberá zápasy, žiadny človek neprepisuje pravdepodobnosť a nič sa po prehre ticho nesťahuje.

V skratke: hodnotenie útoku a obrany vážené podľa veku zápasov sa odhaduje z niekoľkých sezón výsledkov, prevádza sa na úplné rozdelenie možných výsledkov, porovnáva sa s tým, čo oceňuje stávkový trh, a nakoniec sa verejne vyhodnocuje voči skutočnému výsledku. Nasledujúce časti opisujú každý z týchto krokov.

Dáta v základe

Model sa odhaduje na niekoľkých sezónach odohraných zápasov vo všetkých tu pokrytých súťažiach: konečné a polčasové výsledky, získané a inkasované rohy a ďalej strely a držanie lopty, ktoré prináša dátový zdroj a ktoré poháňajú kontextové panely na stránkach aj záložný reťazec modelu rohov. Popri tom stojí snímka kurzov stávkových kancelárií, urobená v okamihu generovania predpovede a obnovovaná, kým sa zápas ešte nezačal. Esport a virtuálne či simulované súťaže sú vylúčené prostredníctvom ručne udržiavaného registra, nie podľa zhody názvov, takže ich výsledky nikdy nemôžu znečistiť hodnotenie skutočného tímu.

Časovo vážené hodnotenie útoku a obrany

Každý tím nesie hodnotenie útoku a hodnotenie obrany — koľko vytvorí a koľko dovolí vzhľadom na svoje prostredie. Oboje sa odhaduje spoločne iteratívnym proporcionálnym vyrovnávaním, riešičom v uzavretom tvare, ktorý strieda útok a obranu, kým celý súbor nereprodukuje gólovú produkciu v ňom skutočne pozorovanú, pričom každý historický zápas je diskontovaný exponenciálnym jadrom aktuálnosti. Nedávna forma prevažuje a staršie sezóny postupne slabnú namiesto toho, aby boli useknuté na ľubovoľnej hranici sezóny. Odhad prebieha vnútri súborov po krajinách, ktoré držia pokope súťaže danej krajiny aj jej domáce poháre: pohárové dvojice tak tvoria mosty medzi úrovňami a nováčik prichádza s hodnotením získaným proti skutočným súperom, nie s prázdnym listom.

Keď je dát málo

Surové hodnotenia príliš reagujú na malé vzorky, a preto je každé z nich ťahané k referenčnej hodnote svojho súboru úmerne dôkazom, ktoré zaň stoja — empiricko-bayesovský krok, ktorý zabráni tomu, aby klub s hŕstkou zaznamenaných zápasov vyzeral ako neporaziteľný len preto, že dva z nich skončili 4:0. Základné hodnoty súťaží prechádzajú rovnakým ošetrením smerom k priemeru súboru, čo bráni tomu, aby malá súťaž vnútri veľkého súboru unikala po šume. Sila tohto ťahu závisí od efektívnej veľkosti vzorky, nie od počtu zápasov, takže silno diskontované staré zápasy právom vážia menej.

Od hodnotenia k rozdeleniu výsledkov

Pre každý zápas dávajú hodnotenia oboch tímov a domáce aj vonkajšie základné hodnoty súťaže očakávaný počet gólov pre každú stranu. Tieto očakávania sa rozvinú do úplnej mriežky pravdepodobností výsledkov — každý vierohodný výsledok od 0:0 vyššie — s Dixon-Colesovou korekciou na dobre zdokumentovanú závislosť medzi oboma skóre v zápasoch s málo gólmi, teda presne tam, kde sa nezávislé Poissonove modely mýlia a kde futbal naozaj žije. Výsledok zápasu, presný výsledok, počet gólov nad/pod, oba tímy skórujú, dvojitá šanca aj ázijský hendikep sa čítajú z jednej a tej istej normalizovanej mriežky. Dva trhy, ktoré zverejňujeme, si preto nemôžu protirečiť: kurz na nad/pod a kurz na presný výsledok sú to isté rozdelenie, len videné dvakrát.

Ako správne čítať trh

Tam, kde kurzy stávkových kancelárií existujú, sa neberú ako hotová vec. Zverejnené kurzy obsahujú maržu stávkovej kancelárie, preto sa z nich marža najprv odpočíta a kurzy sa prevedú na férové pravdepodobnosti. Hendikepové a totalové línie sa potom riešia ako sústava pre dve veličiny, ktoré trh v skutočnosti vyjadruje — prevahu jedného tímu nad druhým a očakávaný počet gólov —, čo je oveľa stabilnejší signál než akýkoľvek jednotlivý kurz. Štvrtinové línie sa oceňujú jadrom s deleným vkladom, ktoré presne ošetruje prípady polovičnej výhry a polovičnej prehry, namiesto zaokrúhlenia na najbližšiu celú líniu, ako to väčšina publikovaných modelov ticho robí.

Samostatný model rohov

Rohy sa neodvodzujú z gólov. Majú vlastné hodnotenie útoku a obrany — získané a inkasované rohy, odhadované tým istým časovo váženým riešičom —, premietajú sa pre každú stranu zvlášť a potom sa oceňujú proti presnej rohovej línii zápasu pomocou diskretizovaného spojitého rozdelenia, nie vyhľadávacou tabuľkou. Keď je rohová história tímu príliš chudobná, model zostupuje po definovanom reťazci: najprv hodnotenia, potom živé štatistiky zápasu, potom samotný trh. Ak žiadna z týchto úrovní neprekročí prah, model uvedie, že dáta nie sú, namiesto toho, aby si číslo vymyslel.

Spojenie vážené presnosťou

Model a trh sa spájajú vážením podľa presnosti založeným na efektívnej veľkosti vzorky: pri tímoch s chudobnou históriou nesie väčšinu váhy trh, v hlboko pokrytých súťažiach model, a prechod medzi nimi je plynulý, nie prepínač. Ak po tomto spojení pretrvá hodnotový rozdiel 5 % alebo viac, tip je označený ako value — model tvrdí, že má výhodu, ktorú kurz neodráža, a hovorí to verejne pred výkopom, kde sa to dá neskôr overiť.

Kalibrácia a testy mimo vzorky

Nič nejde do prevádzky preto, že backtest pekne vyzerá. Model je validovaný na zhruba pol milióna historických zápasov s prísnym oddelením mimo vzorky: hodnotenia sa odhadujú len z toho, čo bolo možné vedieť pred daným výkopom, a výsledky sa hodnotia log-loss a Brierovým skóre — vlastnými bodovacími pravidlami, ktoré trestajú sebaistý omyl namiesto toho, aby ho odmeňovali — spolu s úspešnosťou proti línii a kalibračnými krivkami po pásmach, ktoré overujú, či tip s pravdepodobnosťou 60 % naozaj vychádza zhruba v 60 % prípadov. Verzia, ktorá nedosiahne akceptačné prahy, do prevádzky nejde.

Bez ručného výberu

Každý spôsobilý zápas skutočného futbalu dostane predpoveď — žiadne vyberanie tých ľahkých. Predpovede sa zmrazujú 30 minút pred výkopom a každý zmrazený tip sa vyhodnotí voči konečnému výsledku a započíta do verejnej bilancie úspešnosti, výhry aj prehry rovnako.