MathPredictions

予想の仕組み

当サイトのすべての数値は、どの試合に対しても同じ手順で動く単一の処理パイプラインの出力です。編集者が試合を選ぶことはなく、人が確率を書き換えることもなく、外れた予測がひそかに取り下げられることもありません。

概要:直近ほど重く評価される攻撃力・守備力を複数シーズンの結果から推定し、起こりうるスコアの完全な分布に展開し、ブックメーカー市場が織り込んでいる水準と突き合わせ、最後に実際の結果に対して公開の場で精算します。以下の各節でそれぞれの段階を説明します。

土台となるデータ

モデルは、ここで扱うすべての大会の終了した試合を複数シーズン分用いて推定されます。最終スコアとハーフタイムスコア、獲得・被獲得コーナー数、さらにデータフィードが提供するシュート数とボール支配率で、後者は各ページの状況パネルとコーナーモデルのフォールバック経路を支えます。あわせて、予測生成時に取得し、試合開始前であれば更新され続けるブックメーカーのオッズのスナップショットも保持します。eスポーツおよび仮想・シミュレーション大会は、名称の照合ではなく手作業で維持しているレジストリによって除外されるため、それらのスコアが実在チームの評価を汚染することはありません。

時間減衰を伴う攻撃力・守備力評価

各チームは攻撃力と守備力という二つの評価を持ちます。自らの環境に対してどれだけ生み出し、どれだけ与えているかを表す指標です。両者は反復比例調整法によって同時に推定されます。これは攻撃側と守備側を交互に更新し、プール全体が実際に観測された得点量を再現するまで反復する閉形式のソルバで、過去の各試合は指数関数的な直近度カーネルによって割り引かれます。直近の調子が支配的となり、古いシーズンは任意のシーズン境界で切り捨てられるのではなく滑らかに影響を失っていきます。推定は、その国のリーグ群と国内カップ戦をひとまとめにした国別プールの内部で行われるため、カップ戦の対戦がディビジョン間の橋渡しとなり、昇格チームは白紙からではなく実際の対戦相手から得た評価を持って登場します。

データが乏しい場合の扱い

生の評価は少数サンプルに過剰反応するため、各評価はその裏付けとなる情報量に応じてプールの基準値へ引き戻されます。これは経験ベイズ的な縮小の一手であり、記録された試合が数試合しかないクラブが、そのうち二試合が4-0で終わったというだけで無敵のように見えてしまう事態を防ぎます。リーグの基準値も同様にプール平均へ引き戻され、大きなプールの中の小規模大会がノイズで流されることを防ぎます。この引き戻しの強さは試合数ではなく有効サンプルサイズで決まるため、強く割り引かれた古い試合の重みは適切に小さくなります。

評価からスコア分布へ

各試合について、両チームの評価と大会のホーム・アウェイ基準値から、両サイドの期待得点数が得られます。この期待値は完全なスコア確率行列 — 0-0 以上のあらゆる妥当な結果 — に展開され、得点の少ない試合で両者のスコア間に生じることがよく知られた依存性に対する Dixon-Coles 補正を伴います。独立ポアソンモデルが誤るのは、まさにサッカーが実際に存在するその領域です。試合結果、正確なスコア、得点オーバー/アンダー、両チーム得点、ダブルチャンス、アジアンハンディキャップは、すべてこの一つの正規化された行列から読み取られます。したがって当サイトが公開する二つのマーケットが互いに矛盾することはありません。オーバー/アンダーの価格と正確なスコアの価格は、同じ分布を二度見ているにすぎないからです。

市場を正しく読む

ブックメーカーのオッズがある場合でも、額面どおりには受け取りません。公開オッズにはブックメーカーのマージンが含まれているため、まずそのマージンを除去して公正確率に変換します。次に、ハンディキャップとトータルのラインを連立させ、市場が実際に表現している二つの量 — 両チームの力量差と期待総得点 — について解きます。これは個々のオッズよりもはるかに安定した信号です。クォーターラインは、半勝ち・半負けの分岐を正確に扱う分割ステークのカーネルで評価します。公開されている多くのモデルが黙って行っているような、最も近い整数ラインへの丸めは行いません。

専用のコーナーモデル

コーナーは得点から導かれるものではありません。獲得・被獲得コーナー数について独自の攻撃力・守備力評価を持ち、同じ時間重み付きソルバで推定され、各サイドについて予測されたうえで、参照表ではなく離散化した連続分布によって、その試合の実際のコーナーラインに対して価格付けされます。あるチームのコーナー履歴が信頼するには薄すぎる場合、モデルは定められた経路を順に降りていきます。まず評価、次にライブの試合スタッツ、次に市場のみ。いずれも基準を満たさない場合は、数値をでっち上げるのではなく「データなし」と表示します。

精度重み付けによる統合

モデルと市場は、有効サンプルサイズに基づく精度重み付けによって統合されます。履歴の薄いチームでは市場が重みの大半を担い、深くカバーされたリーグではモデルが大半を担い、その移行はスイッチではなく連続的です。この統合後にも 5% 以上のバリューギャップが残る場合、その予想はバリューとして表示されます。モデルがオッズに反映されていない優位性を主張しているということであり、それをキックオフ前に公開の場で明示し、後から検証できる形で残します。

較正とサンプル外検証

見栄えのよいバックテストを理由に公開されるものは一つもありません。エンジンは約50万試合の過去データを用い、厳密なサンプル外分離のもとで検証されます。評価は各キックオフ以前に知りえた情報のみから推定され、結果は対数損失とブライアスコア — 自信を伴う誤りを報いるのではなく罰する厳密なスコアリングルール — に加えて、ラインに対する的中率、および 60% と告げた予測が実際におよそ 60% 的中しているかを確認する区間別の較正曲線によって評価されます。受け入れ基準に達しないバージョンは公開されません。

恣意的な選別なし

対象となる実在の試合はすべて予測の対象です。簡単な試合だけを選ぶことはしません。予測はキックオフの30分前に凍結され、凍結されたすべての予想は最終結果に対して精算され、的中も外れも同じように公開の的中実績に計上されます。