Cum funcționează POSEIDON
1. Ratings echipă (Poisson Bayesian)
Fiecare echipă primește două rate-uri relative:
- Attack — golurile marcate ÷ media ligii (1.0 = echipă medie)
- Defense — golurile primite ÷ media ligii (mai mic = mai bine)
Rate-urile sunt ponderate cu time-decay exponențial — meciurile recente contează mai mult decât cele vechi. Bootstrap pentru intervale de încredere.
2. Lambda per meci (xG estimat)
Pentru un meci HOME vs AWAY:
λ_home = attack_HOME × defense_AWAY × home_advantage × μ_league_calibrat λ_away = attack_AWAY × defense_HOME × μ_league_calibrat
Unde μ_league_calibrat = media ligii × scale per-ligă, calibrată empiric.
3. Calibrare per-ligă (anti-bias)
Modelul fără calibrare supra-estimează masiv ligile cu scor mare (Nordic +22%) și sub-estimează cele cu scor mic (Sud-America −22%). Soluție: un factor de scalare per ligă, derivat exclusiv pe TRAIN, cu shrinkage Bayesian spre o medie prudentă — aplicat mai puternic pe ligile cu sample mic, pentru a evita supra-fitarea.
Din 12 iunie 2026, probabilitățile afișate sunt în plus calibrate per piață (corecție de pantă Platt pe logit, validată pe ferestre temporale separate ian–mar / apr–mai). Efect practic: pe piețele unde modelul era supra-încrezător, probabilitățile corectate sunt mai mici decât cele brute — unele piețe nu mai ating zona de 70%+ — iar probabilitatea pe victoria gazdelor e plafonată la 80%.
4. Simulare Monte Carlo (200k–1M iterații)
Pentru fiecare meci, lambda_home și lambda_away sunt sample-uite din distribuții Normal posteriori (cu varianța din bootstrap), apoi se simulează golurile cu Poisson. Probabilitățile 1X2, Over/Under, BTTS, scor exact se obțin din 200k+ partide simulate.
5. Dixon-Coles correction
Poisson clasic sub-estimează scoruri low (0-0, 1-0, 0-1, 1-1). Corecția ρ, fitată pe meciurile recente, ajustează matricea Poisson pe scorurile mici.
Whitelist & blacklist ligi
După backtest pe 65.250 meciuri jucate în ianuarie–mai 2026, cu ratings calculate strict pe 2024–2025 (înghețate la 31 dec 2025), ligile sunt clasificate:
- Calibrate (270 ligi): bias între ±10% pe sample N≥80 — modelul livrează predicții fiabile.
- Necalibrate: bias mai mare ±10% sau sample insuficient — predicțiile sunt afișate dar cu marker ⚠️ ligă necalibrată.
- Blacklist: ligi cu anomalii structurale (date corupte, scoruri suspecte) — predicțiile NU sunt afișate.
Limitări cunoscute
- Modelul nu vede: schimbări recente lot, accidentări, motivație, vreme, arbitraj.
- Modelul nu prezice: scorul exact (e probabilistic), goluri în minute specifice.
- Pe ligi necalibrate sau cu sample mic (N<80), predicțiile pot diverge de realitate.
Filozofie
Modelul NU înlocuiește gândirea. Predicțiile arată cât de des s-a întâmplat un eveniment în condiții similare, nu garanție de viitor. Dacă POSEIDON zice 60% Over 2.5, asta înseamnă că în condiții identice istorice s-a întâmplat ~60% din timp — care e diferit de "se va întâmpla".