12. 5. 2026

5 1

Puntuación de degradación IS y OOS

Para qué sirve

Cada backtest robusto reserva una parte de los datos con los que la estrategia nunca se optimizó: el periodo fuera de muestra. La respuesta honesta a “¿Esta estrategia aprendió realmente el mercado, o sólo memorizó los datos de entrenamiento?” vive en la diferencia entre el rendimiento IS y el OOS. Este complemento calcula esa diferencia automáticamente, para cada métrica clave, y la condensa en algo que puedes leer en menos de diez segundos.

Abra el IS ↔ OOS Cuadro de mando de la degradación en Resultados, seleccione cualquier estrategia con una división IS/OOS, y el plugin hará el resto.

 

Lo que obtiene

  • Una única nota compuesta (A-F) con una puntuación de 0 a 100, codificada por colores para que un simple vistazo nos lo cuente todo.
  • Un panel de conclusiones que convierte los números en inglés sencillo: “El factor Profit cayó por debajo de 1,0: la estrategia no es rentable fuera de la muestra”“Reducción máxima de más del doble”“El porcentaje de victorias se mantiene (52% → 51%)”. Las seis observaciones más importantes, priorizadas de críticas a buenas.
  • Una tabla métrica en paralelo a través de 10 indicadores de robustez: Profit Factor, R-Expectancy, Max Drawdown %, Return/DD, Sharpe, Win Rate, Stability, SQN, monthly profit, y long/short symmetry. Cada fila muestra el valor IS, el valor OOS, el cambio % y una barra de puntuación individual 0-100.
  • Una pancarta de adecuación que avisa cuando sólo se tienen 22 operaciones OOS y el resultado, por bueno que sea, carece de sentido estadístico.
  • Información emergente sobre cada métrica explicando qué es, qué implica su cambio IS→OOS y qué se considera alarmante.

Cómo funciona la puntuación

Cada métrica se puntúa en una curva de retención: ¿cómo se mantiene el rendimiento OOS frente al IS? La retención total (o mejora) se puntúa con 100; el deterioro leve, con 75; el deterioro significativo, con 40; y el colapso, con 0. Los cambios de signo críticos (Factor Profit por debajo de 1,0, esperanza negativa, Sharpe negativo) fuerzan la puntuación de la métrica directamente a cero, porque en esos casos la estrategia se ha roto fundamentalmente. A continuación, las métricas se combinan con ponderaciones de riesgo que otorgan la misma importancia a la rentabilidad, el riesgo y la coherencia.

A quién va dirigido

  • Desarrolladores de estrategias hacer una última comprobación antes de añadir un candidato a una cartera.
  • Prop comerciantes en firme que necesitan estar seguros de que una estrategia de evaluación aprobada no se ajustó a la curva.
  • Quants revisando los lotes de estrategias generadas por AlgoWizard o Builder - ordenar por nota, centrarse en las As y las B, desechar las F.

Lo que no es

Se trata de una heurística estadística, no de una garantía. Una buena nota significa que la estrategia ha sobrevivido a una única división de holdouts, pero no predice el rendimiento en directo. Utilícela como un filtro entre varios (Monte Carlo, walk-forward, pruebas de robustez), no como el único.

1 Comentario
Más antiguo
Más reciente Más votados
Emmanuel Evrard
Editor
28. 5. 2026 12:21 pm

Esto es interesante. ¡Gracias Tomas !