MathPredictions

Como funcionam nossas previsões

Cada número deste site é a saída de uma única linha de processamento que roda do mesmo jeito para todas as partidas. Nenhum editor escolhe os jogos, nenhuma pessoa sobrescreve uma probabilidade e nada é retirado discretamente depois de errar.

Em resumo: avaliações de ataque e defesa ponderadas pela recência são ajustadas a partir de várias temporadas de resultados, transformadas em uma distribuição completa dos placares possíveis, confrontadas com o que o mercado de apostas está precificando e, por fim, liquidadas publicamente contra o resultado real. As seções abaixo detalham cada uma dessas etapas.

Os dados por trás

O motor é ajustado sobre várias temporadas de partidas encerradas em todas as competições cobertas aqui: placares finais e do intervalo, escanteios conquistados e cedidos, além das finalizações e da posse de bola que a fonte de dados fornece e que alimentam os painéis de contexto das páginas e a cadeia de fallback do modelo de escanteios. Junto a isso há um instantâneo das odds das casas de apostas, capturado quando a previsão é gerada e atualizado enquanto a partida ainda está aberta. Esports e competições virtuais ou simuladas são excluídos por um registro mantido manualmente, e não por correspondência de nomes, de modo que seus placares jamais contaminem a avaliação de um time real.

Avaliações de ataque e defesa ponderadas no tempo

Cada time carrega uma avaliação de ataque e uma de defesa — quanto cria e quanto cede em relação ao próprio ambiente. As duas são ajustadas em conjunto por ajuste proporcional iterativo, um solucionador de forma fechada que alterna entre ataque e defesa até que todo o grupo reproduza o volume de gols nele realmente observado, com cada partida histórica descontada por um núcleo exponencial de recência. A forma recente domina e as temporadas antigas se apagam suavemente, em vez de serem cortadas em um limite de temporada arbitrário. O ajuste acontece dentro de grupos por país, que reúnem as divisões de uma nação junto com suas copas nacionais: assim os confrontos de copa funcionam como pontes entre divisões, e um time recém-promovido chega com uma avaliação conquistada diante de adversários reais, e não com uma folha em branco.

Quando o histórico é curto

Avaliações brutas reagem demais a amostras pequenas, então cada uma é puxada na direção da referência do seu grupo na proporção da evidência que a sustenta — um passo bayesiano empírico que impede que um clube com um punhado de jogos registrados pareça imbatível porque dois deles terminaram 4 a 0. As taxas-base das ligas recebem o mesmo tratamento em relação à média do grupo, o que evita que uma competição pequena se desloque por puro ruído dentro de um grupo grande. A força desse puxão vem do tamanho efetivo da amostra, não da contagem de jogos, de modo que partidas antigas fortemente descontadas pesam menos, como devem.

Das avaliações à distribuição de placares

Para cada partida, as avaliações dos dois times e as taxas-base de mandante e visitante da competição produzem um número esperado de gols para cada lado. Essas expectativas se abrem em uma matriz completa de probabilidades de placar — todo resultado plausível a partir do 0 a 0 — carregando a correção de Dixon-Coles para a dependência bem documentada entre os dois placares em jogos de poucos gols, que os modelos de Poisson independentes erram justamente onde o futebol de fato acontece. Resultado da partida, placar exato, mais/menos gols, ambos marcam, dupla chance e handicap asiático são todos lidos dessa mesma matriz normalizada. Por isso dois mercados que publicamos não podem se contradizer: a odd do mais/menos e a do placar exato são a mesma distribuição, vista duas vezes.

Ler o mercado corretamente

Onde existem odds de casas de apostas, elas não são aceitas ao pé da letra. As odds publicadas embutem a margem da casa, então primeiro essa margem é removida e elas viram probabilidades justas. Em seguida, as linhas de handicap e de total são resolvidas como um sistema para as duas grandezas que o mercado realmente expressa — a superioridade entre os times e o total de gols esperado —, um sinal muito mais estável do que qualquer preço isolado. Linhas de quarto são precificadas por um núcleo de aposta dividida que trata com exatidão os casos de meia vitória e meia derrota, em vez de arredondá-las para a linha inteira mais próxima, como a maioria dos modelos publicados faz silenciosamente.

Um modelo específico de escanteios

Escanteios não são inferidos a partir dos gols. Eles têm avaliações próprias de ataque e defesa — escanteios conquistados e cedidos, ajustados pelo mesmo solucionador ponderado no tempo —, são projetados para cada lado e depois precificados contra a linha de escanteios exata da partida por meio de uma distribuição contínua discretizada, e não de uma tabela de consulta. Quando o histórico de escanteios de um time é curto demais para ser confiável, o modelo degrada por uma cadeia definida: primeiro as avaliações, depois as estatísticas ao vivo da partida, depois apenas o mercado. Se nenhuma dessas etapas atinge o limite exigido, ele informa que não há dados em vez de inventar um número.

Combinação ponderada pela precisão

Modelo e mercado são combinados por ponderação de precisão baseada no tamanho efetivo da amostra: o mercado carrega a maior parte do peso para times com histórico curto, o modelo carrega a maior parte em ligas com cobertura profunda, e a transição entre os dois é contínua, não um interruptor. Quando sobrevive a essa combinação uma diferença de valor de 5% ou mais, o palpite é marcado como value — o modelo afirma ter uma vantagem que o preço não reflete, e diz isso publicamente antes de a bola rolar, onde qualquer um pode conferir depois.

Calibração e testes fora da amostra

Nada vai ao ar por causa de um backtest bonito. O motor é validado em cerca de meio milhão de partidas históricas com separação rigorosa fora da amostra: as avaliações são ajustadas apenas com o que era possível saber antes de cada início, e os resultados são pontuados por log-loss e escore de Brier — regras de pontuação próprias, que punem o erro confiante em vez de premiá-lo —, além do aproveitamento contra a linha e de curvas de calibração por faixas, que verificam se uma previsão de 60% realmente acerta cerca de 60% das vezes. Uma versão que não atinge seus limites de aceitação não entra em produção.

Sem seleção manual

Toda partida de futebol real elegível recebe uma previsão — nada de escolher as fáceis. As previsões são congeladas 30 minutos antes do início, e cada palpite congelado é liquidado contra o resultado final e contabilizado no histórico público de acerto, acertos e erros igualmente.