Evaluación histórica
¿Cómo se habría comportado nuestro modelo utilizando únicamente la información disponible antes de cada partido histórico?
Calibración del modelo
La Liga · 2020-21 → 2024-25 · 1,900 partidos evaluados
Cuando el modelo asigna una probabilidad, ¿con qué frecuencia ocurre realmente el resultado?
Cuanto más cerca de la diagonal, mejor calibrado está el modelo.
Cada partido aporta tres probabilidades (local, empate, visitante). Se omiten los rangos con menos de 30 puntos.
Por rangos
Los rangos más informativos y los que más se alejan de la diagonal.
- 15–20%modelo 17.6%observado 15.3%
- 20–25%modelo 22.9%observado 21.6%
- 25–30%modelo 27.3%observado 28.1%
- 30–35%modelo 32.2%observado 30.6%
- 50–55%modelo 52.3%observado 55.0%
- 65–70%modelo 67.2%observado 74.8%
- 80–85%modelo 81.8%observado 71.4%
Equivalente en escala 0–2: 0.592
Cómo leerlo
Si el modelo asigna una probabilidad cercana al 60%, esperamos que ese resultado ocurra aproximadamente 6 de cada 10 veces a lo largo de muchas observaciones.
Una buena calibración no significa acertar siempre; significa que las probabilidades se parecen a la frecuencia real.
Evaluación histórica, sin mirar el resultado.
Cada predicción simulada utiliza únicamente información disponible antes del partido.
Conoce nuestra metodología