Métricas de error de predicción
  • Teoría
  • Simulación interactiva
  • Resultados e interpretación

Métricas de error: RECM, EAM, EAMP y MASE

Sea \(e_t=y_t-\hat y_t\) el error de predicción en el periodo \(t\), para \(t=1,\dots,H\) periodos evaluados. Las métricas de error más habituales son:

$$\text{RECM} = \sqrt{\frac{1}{H}\sum_{t=1}^H e_t^2}, \qquad \text{EAM} = \frac{1}{H}\sum_{t=1}^H |e_t|, \qquad \text{EAMP} = \frac{100}{H}\sum_{t=1}^H \left|\frac{e_t}{y_t}\right|.$$

La raíz del error cuadrático medio de predicción (RECM) eleva el error al cuadrado antes de promediar: los errores grandes pesan desproporcionadamente más que los pequeños, por lo que el RECM es especialmente sensible a unos pocos fallos de predicción muy grandes (\(\textit{outliers}\)). El error absoluto medio (EAM) trata todos los errores por igual en valor absoluto, sin la penalización cuadrática extra. Ambos se expresan en las unidades originales de la variable, lo que impide comparar directamente el error de un modelo sobre el IPC con el de otro modelo sobre el PIB.

El error absoluto medio porcentual (EAMP) evita ese problema al expresar el error como porcentaje del valor observado, pero falla cuando la serie toma valores próximos a cero: dividir por un \(y_t\) minúsculo dispara el error relativo de forma artificial, incluso si el error absoluto \(e_t\) es pequeño.

El error absoluto medio escalado (MASE)

Hyndman y Koehler proponen expresar el error relativo al error de un modelo de referencia elemental —el naive estacional, \(\hat y_t=y_{t-m}\)— sobre la propia muestra de estimación:

$$\text{MASE} = \frac{\dfrac{1}{H}\displaystyle\sum_{t=1}^{H}|e_t|}{\dfrac{1}{n-m}\displaystyle\sum_{i=m+1}^{n}|y_i-y_{i-m}|}.$$

Como numerador y denominador están en las mismas unidades, el cociente es adimensional: un MASE < 1 indica que el modelo predice mejor, en promedio, que la referencia naive estacional; un MASE > 1, que ni siquiera la supera. Al ser adimensional, el MASE sí permite comparar la calidad predictiva de modelos ajustados sobre series de escalas completamente distintas.

Distintas sensibilidades

  • RECM: penaliza desproporcionadamente los errores grandes; útil cuando los fallos extremos son especialmente costosos.
  • EAM: más robusto a valores atípicos que el RECM; da una idea más 'típica' del error cometido.
  • EAMP: fácil de interpretar como porcentaje, pero inestable o directamente indefinido cuando \(y_t\) se acerca a cero.
  • MASE: adimensional y comparable entre series, con la referencia interpretable de '1' como umbral frente al naive estacional.

Parámetros del error simulado

Métricas calculadas

Predicciones y errores individuales

Interpretación econométrica