Co właściwie prognozujemy?
MatchupLab nie próbuje przewidzieć jednego „pewnego” wyniku. Model szacuje prawdopodobieństwo określonego zdarzenia, na przykład co najmniej trzech goli, bramki obu drużyn, określonej liczby rzutów rożnych lub kartek. To subtelna, ale kluczowa różnica: prawdopodobieństwo 70% nadal oznacza, że w zbliżonych warunkach około trzy przypadki na dziesięć mogą zakończyć się inaczej.
Chronologia jest święta
Walk-forward
Model uczony jest wyłącznie na meczach rozegranych wcześniej. Następny fragment czasu służy jako niewidziany test.
Forward-only
Prognoza produkcyjna zostaje zapisana przed rozpoczęciem meczu i nie może być poprawiona po poznaniu wyniku.
Brak przecieku danych
Cechy zespołów powstają tylko z informacji dostępnych w chwili prognozy. Przyszły wynik nie może wejść do średnich ani formy.
Test w czasie
Oceniamy kilka kolejnych okresów. Jeden udany sezon lub liga nie wystarcza, aby uznać przewagę za trwałą.
Kalibracja zamiast samej skuteczności
Jeżeli model wielokrotnie podaje 70%, interesuje nas, czy zdarzenie zachodzi mniej więcej siedem razy na dziesięć. To właśnie kalibracja. Model może mieć wysoką skuteczność, a jednocześnie być nadmiernie pewny siebie. Dlatego obok trafień sprawdzamy między innymi Brier score, log loss i wykresy kalibracji.
Modele dopasowane do zjawiska
Gole, rożne i kartki są danymi zliczeniowymi, lecz mają inną dynamikę. Dla goli użyteczne są rozkłady Poissona i ich rozszerzenia. Rożne oraz kartki bywają bardziej zmienne, dlatego sprawdzamy również modele Negative Binomial. Wynik końcowy może pochodzić z zespołu modeli, o ile ich zgodność i niepewność są jawne.
Co wchodzi do cech?
- ważona czasowo forma zamiast prostych średnich,
- siła poprzednich przeciwników,
- różnice między grą u siebie i na wyjeździe,
- tempo, profil ataku i obrony oraz stabilność składu,
- specyfika ligi, sędzia i kontekst spotkania, gdy dane są znane przed meczem.
Backtest nie jest dowodem przewagi nad rynkiem
Backtest odpowiada na pytanie, czy pomysł zasługuje na dalsze badanie. O realnej wartości zdecyduje dopiero duża próbka prognoz forward-only, stabilna kalibracja, dodatni CLV i ROI, które nie zależy od kilku szczęśliwych wyników. Z tego powodu rejestry MatchupLab są append-only, a słabszych okresów nie usuwamy.
Jak czytać nasze przyszłe raporty?
- Sprawdź liczbę niezależnych obserwacji.
- Zobacz okres i ligi objęte analizą.
- Porównaj deklarowane prawdopodobieństwo z rzeczywistą częstością.
- Oceń przedział niepewności i zgodność modeli.
- Dopiero na końcu patrz na wynik finansowy.