12. 5. 2026

5 1

Pontuação de degradação de IS e OOS

O que ele faz

Todo backtest robusto reserva uma parte dos dados em que a estratégia nunca foi otimizada - o período fora da amostra. A resposta honesta para “Essa estratégia realmente aprendeu o mercado ou apenas memorizou os dados de treinamento?” vive na lacuna entre o desempenho IS e OOS. Esse plug-in calcula essa diferença automaticamente, para cada métrica principal, e a condensa em algo que você pode ler em menos de dez segundos.

Abra o Cartão de Pontuação de Degradação IS ↔ OOS em Resultados, selecione qualquer estratégia com uma divisão IS/OOS, e o plug-in fará o resto.

 

O que você recebe

  • Uma única nota composta (A-F) com uma pontuação de 0 a 100, codificada por cores para que uma olhada conte a história.
  • Um painel de descobertas que transforma os números em inglês simples: “Profit Factor caiu abaixo de 1,0 - a estratégia não é lucrativa fora da amostra”“O drawdown máximo mais do que dobrou”“Taxa de vitórias mantida (52% → 51%)”. As seis principais observações mais importantes, priorizadas de críticas a boas.
  • Uma tabela métrica lado a lado em 10 indicadores de robustez: Profit Factor, R-Expectancy, Max Drawdown %, Return/DD, Sharpe, Win Rate, Stability, SQN, lucro mensal e simetria long/short. Cada linha mostra o valor IS, o valor OOS, a alteração do % e uma barra de pontuação individual de 0 a 100.
  • Um banner de adequação que avisa quando você tem apenas 22 negociações OOS e o resultado, por melhor que seja, não tem significado estatístico.
  • Dicas de ferramentas com foco em cada métrica, explicando o que ela é, o que sua mudança IS→OOS implica e o que é considerado alarmante.

Como funciona a pontuação

Cada métrica é pontuada em uma curva de retenção - até que ponto o desempenho OOS se mantém em relação ao IS? A retenção total (ou melhoria) tem pontuação 100; a deterioração leve tem pontuação 75; a deterioração significativa tem pontuação 40; o colapso tem pontuação 0. Reversões de sinais críticos (Profit Factor cruzando abaixo de 1,0, expectativa tornando-se negativa, Sharpe tornando-se negativo) forçam a pontuação da métrica diretamente para zero, porque nesses casos a estratégia quebrou fundamentalmente. As métricas são então combinadas com pesos ponderados pelo risco que dão igual importância à lucratividade, ao risco e à consistência.

A quem se destina

  • Desenvolvedores de estratégias fazer a verificação final de sanidade antes de adicionar um candidato a um portfólio.
  • Prop comerciantes firmes que precisam ter certeza de que uma estratégia de avaliação aprovada não foi ajustada à curva.
  • Revisão de lotes pelos cotistas de estratégias geradas pelo AlgoWizard ou Builder - classifique por nota, concentre-se nos As e Bs, jogue os Fs para trás.

O que não é

Trata-se de uma heurística estatística, não de uma garantia. Uma boa nota significa que a estratégia sobreviveu a uma única divisão de holdout - ela não prevê o desempenho ao vivo. Use-a como um filtro entre vários (Monte Carlo, walk-forward, testes de robustez), não como o único.

1 Comentário
mais antigos
mais recentes Mais votado
Emmanuel Evrard
Editor
28. 5. 2026 12:21 pm

Isso é interessante! Obrigado, Tomas!