Pontuação de degradação de IS e OOS
Conteúdo da página
O que ele faz
Todo backtest robusto reserva uma parte dos dados em que a estratégia nunca foi otimizada - o período fora da amostra. A resposta honesta para “Essa estratégia realmente aprendeu o mercado ou apenas memorizou os dados de treinamento?” vive na lacuna entre o desempenho IS e OOS. Esse plug-in calcula essa diferença automaticamente, para cada métrica principal, e a condensa em algo que você pode ler em menos de dez segundos.
Abra o Cartão de Pontuação de Degradação IS ↔ OOS em Resultados, selecione qualquer estratégia com uma divisão IS/OOS, e o plug-in fará o resto.
O que você recebe
- Uma única nota composta (A-F) com uma pontuação de 0 a 100, codificada por cores para que uma olhada conte a história.
- Um painel de descobertas que transforma os números em inglês simples: “Profit Factor caiu abaixo de 1,0 - a estratégia não é lucrativa fora da amostra”, “O drawdown máximo mais do que dobrou”, “Taxa de vitórias mantida (52% → 51%)”. As seis principais observações mais importantes, priorizadas de críticas a boas.
- Uma tabela métrica lado a lado em 10 indicadores de robustez: Profit Factor, R-Expectancy, Max Drawdown %, Return/DD, Sharpe, Win Rate, Stability, SQN, lucro mensal e simetria long/short. Cada linha mostra o valor IS, o valor OOS, a alteração do % e uma barra de pontuação individual de 0 a 100.
- Um banner de adequação que avisa quando você tem apenas 22 negociações OOS e o resultado, por melhor que seja, não tem significado estatístico.
- Dicas de ferramentas com foco em cada métrica, explicando o que ela é, o que sua mudança IS→OOS implica e o que é considerado alarmante.
Como funciona a pontuação
Cada métrica é pontuada em uma curva de retenção - até que ponto o desempenho OOS se mantém em relação ao IS? A retenção total (ou melhoria) tem pontuação 100; a deterioração leve tem pontuação 75; a deterioração significativa tem pontuação 40; o colapso tem pontuação 0. Reversões de sinais críticos (Profit Factor cruzando abaixo de 1,0, expectativa tornando-se negativa, Sharpe tornando-se negativo) forçam a pontuação da métrica diretamente para zero, porque nesses casos a estratégia quebrou fundamentalmente. As métricas são então combinadas com pesos ponderados pelo risco que dão igual importância à lucratividade, ao risco e à consistência.
A quem se destina
- Desenvolvedores de estratégias fazer a verificação final de sanidade antes de adicionar um candidato a um portfólio.
- Prop comerciantes firmes que precisam ter certeza de que uma estratégia de avaliação aprovada não foi ajustada à curva.
- Revisão de lotes pelos cotistas de estratégias geradas pelo AlgoWizard ou Builder - classifique por nota, concentre-se nos As e Bs, jogue os Fs para trás.
O que não é
Trata-se de uma heurística estatística, não de uma garantia. Uma boa nota significa que a estratégia sobreviveu a uma única divisão de holdout - ela não prevê o desempenho ao vivo. Use-a como um filtro entre vários (Monte Carlo, walk-forward, testes de robustez), não como o único.

Isso é interessante! Obrigado, Tomas!