StratCraftStratCraftPortuguês
Back to strategies

Estratégia de classificador Random Forest

Classificar a direção do mercado do próximo período com um ensemble de árvores de decisão

Estratégia de classificador Random Forest é um modelo de trading de machine learning que converte características técnicas, de volatilidade, de volume e de regime num sinal classificador Random Forest validado e depois aplica controlos explícitos de execução, saída e risco do modelo. - Breiman 2001

Esta estratégia é fornecida como um exemplo educacional inspirado em conceitos comuns de análise técnica pública e material de referência. É apenas para pesquisa e demonstração de produtos e não constitui aconselhamento de investimento.

⚠️ Adequação da estratégia
RISCO: HIGH
Ideal para
  • Mercados onde características técnicas, de volatilidade, de volume e de regime estão disponíveis point-in-time e podem ser mapeadas para ordens executáveis.
  • Fluxos de pesquisa capazes de validar classificador Random Forest com divisões cronológicas em vez de baralhamentos aleatórios.
  • Carteiras onde a probabilidade de classe e a margem de votos ultrapassam o limiar testado é forte o suficiente para sobreviver a custos, rotação e decaimento do modelo.
Evitar em
  • Conjuntos de dados com viés de sobrevivência, características look-ahead, fundamentais revistos ou rótulos que não eram negociáveis no momento da decisão.
  • Mercados onde a vantagem prevista é menor do que os custos de spread, slippage, empréstimo ou latência.
  • Pesquisa sobreajustada onde a complexidade do modelo cresce mais depressa do que a evidência fora da amostra.
🕒 Períodos de tempo
IntradayDailyWeekly
🌍 Mercados
StocksETFsFuturesCrypto
📢 As estratégias de machine learning podem parecer precisas enquanto escondem fugas ou sobreajuste de regime; a calibração de probabilidades, os limites de profundidade das árvores e os stops por deriva das características precisa de monitorização explícita.
P: Qual é a ideia central por trás de Estratégia de classificador Random Forest?
A estratégia treina classificador Random Forest em características técnicas, de volatilidade, de volume e de regime, prevê a direção ou a faixa de retorno do próximo período e só negoceia quando a probabilidade de classe e a margem de votos ultrapassam o limiar testado.
P: Qual é o maior risco em Estratégia de classificador Random Forest?
O maior risco costuma ser a fuga de dados ou o sobreajuste: o backtest pode usar informação que não teria existido antes do trade.
P: Como deve Estratégia de classificador Random Forest ser backtestado?
Use dados point-in-time, validação walk-forward cronológica, custos de transação realistas e um período final fora da amostra intacto antes da implementação.

Como esta estratégia funciona

Fluxo de decisão de 5 etapas, da leitura de mercado à gestão de trades

1
Conjunto de características
Construir entradas point-in-time
Construir características técnicas, de volatilidade, de volume e de regime sem fuga de informação futura
Alinhar cada característica ao timestamp em que teria sido conhecida
Remover entradas instáveis, esparsas ou impossíveis de executar antes do treino
BBMACD
2
Desenho do alvo
Definir rótulos negociáveis
Treinar o modelo para prever a direção ou a faixa de retorno do próximo período
Separar cronologicamente os períodos de treino, validação e teste em estilo real
Rejeitar definições de alvo que ignorem custos, latência, empréstimo ou pressupostos de execução
ToqueCruzamento se aproximando
3
Validação
Testar a estabilidade do modelo
Validar com uma validação fora da amostra móvel do ensemble de árvores
Comparar a capacidade de previsão com um benchmark simples baseado em regras
Inspecionar a importância das características, a calibração e a sensibilidade ao regime antes da implementação
Sinal BBCruzamento MACD✓ GO
4
Regra de trading
Converter a pontuação em ordens
Acionar apenas quando a probabilidade de classe e a margem de votos ultrapassam o limiar testado
Executar com ordens na barra seguinte ou na janela de rebalanceamento após a filtragem por probabilidade
Sair quando a probabilidade cai abaixo do limiar, a classe inverte ou o horizonte de previsão expira
COMPRAParcialVENDAZona de lucro
5
Risco do modelo
Controlar a deriva e o sobreajuste
Aplicar a calibração de probabilidades, os limites de profundidade das árvores e os stops por deriva das características antes do uso em real
Monitorizar o decaimento da previsão, as mudanças de esquema de dados e a deriva da distribuição das características
Retirar o modelo quando as decisões em real divergirem do comportamento validado
EntradaSLTPStop dinâmico2%R:R
Referência de componentes de estratégia

Estratégia de classificador Random Forest

Classificar a direção do mercado do próximo período com um ensemble de árvores de decisão

Random
Forest
Sinal
SC StratCraft
FConjunto de características
características técnicas, de volatilidade, de volume e de regimeEntradas do modelo
a direção ou a faixa de retorno do próximo períodoAlvo de treino
Alinhamento point-in-timeControlo de fugas
MTreino do modelo
classificador Random ForestMotor de previsão
uma validação fora da amostra móvel do ensemble de árvoresTeste fora da amostra
Modelo de referênciaLimiar de competência
ERegras de entrada
a probabilidade de classe e a margem de votos ultrapassam o limiar testadoGatilho de trade
ordens na barra seguinte ou na janela de rebalanceamento após a filtragem por probabilidadeMétodo de ordem
Calibração da pontuaçãoFiltro de confiança
XRegras de saída
a probabilidade cai abaixo do limiar, a classe inverte ou o horizonte de previsão expiraFecho principal
Atualização da previsãoAtualização do modelo
Expiração do sinalSaída por sinal obsoleto
RControlo de risco
a calibração de probabilidades, os limites de profundidade das árvores e os stops por deriva das característicasControlos rígidos
Deriva das característicasSaúde dos dados
Revisão de sobreajusteDisciplina de pesquisa
Estratégia de classificador Random Forest
Estratégia de classificador Random Forest é um modelo de trading de machine learning que converte características técnicas, de volatilidade, de volume e de regime num sinal classificador Random Forest validado e depois aplica controlos explícitos de execução, saída e risco do modelo.
Estratégia de classificador Random Forest Market Suitability
The Estratégia de classificador Random Forest strategy works best in Mercados onde características técnicas, de volatilidade, de volume e de regime estão disponíveis point-in-time e podem ser mapeadas para ordens executáveis.. Fluxos de pesquisa capazes de validar classificador Random Forest com divisões cronológicas em vez de baralhamentos aleatórios.. Carteiras onde a probabilidade de classe e a margem de votos ultrapassam o limiar testado é forte o suficiente para sobreviver a custos, rotação e decaimento do modelo.. Traders should avoid using this strategy in Conjuntos de dados com viés de sobrevivência, características look-ahead, fundamentais revistos ou rótulos que não eram negociáveis no momento da decisão.. Mercados onde a vantagem prevista é menor do que os custos de spread, slippage, empréstimo ou latência.. Pesquisa sobreajustada onde a complexidade do modelo cresce mais depressa do que a evidência fora da amostra.. The risk level is categorized as HIGH. As estratégias de machine learning podem parecer precisas enquanto escondem fugas ou sobreajuste de regime; a calibração de probabilidades, os limites de profundidade das árvores e os stops por deriva das características precisa de monitorização explícita.
Qual é a ideia central por trás de Estratégia de classificador Random Forest?
A estratégia treina classificador Random Forest em características técnicas, de volatilidade, de volume e de regime, prevê a direção ou a faixa de retorno do próximo período e só negoceia quando a probabilidade de classe e a margem de votos ultrapassam o limiar testado.
Qual é o maior risco em Estratégia de classificador Random Forest?
O maior risco costuma ser a fuga de dados ou o sobreajuste: o backtest pode usar informação que não teria existido antes do trade.
Como deve Estratégia de classificador Random Forest ser backtestado?
Use dados point-in-time, validação walk-forward cronológica, custos de transação realistas e um período final fora da amostra intacto antes da implementação.
características técnicas, de volatilidade, de volume e de regime
características técnicas, de volatilidade, de volume e de regime formam as entradas observáveis usadas pelo modelo; cada valor tem de estar disponível antes do timestamp de decisão simulado. Formula: Point-in-time feature matrix
a direção ou a faixa de retorno do próximo período
a direção ou a faixa de retorno do próximo período define o que o modelo tenta prever, pelo que tem de incluir um horizonte de detenção e um pressuposto de custos de transação realistas. Formula: Future return or action label
Alinhamento point-in-time
O alinhamento point-in-time impede que o modelo aprenda informação revista ou futura que não existiria durante o trading em real. Formula: Feature time <= decision time
classificador Random Forest
classificador Random Forest transforma as características de mercado projetadas numa pontuação, classe, previsão ou ação que pode ser testada em períodos não vistos. Formula: Prediction = majority vote of decorrelated trees
uma validação fora da amostra móvel do ensemble de árvores
uma validação fora da amostra móvel do ensemble de árvores verifica se o modelo treinado continua útil quando avaliado em dados posteriores que não foram usados no treino. Formula: Walk-forward split
Modelo de referência
Um modelo de referência confirma que a complexidade do machine learning acrescenta valor para além de uma simples regra de momentum, reversão à média ou fator. Formula: Compare with simple baseline
a probabilidade de classe e a margem de votos ultrapassam o limiar testado
a probabilidade de classe e a margem de votos ultrapassam o limiar testado transforma a saída do modelo numa regra de entrada estrita em vez de tratar cada previsão como um trade. Formula: Prediction score clears threshold
ordens na barra seguinte ou na janela de rebalanceamento após a filtragem por probabilidade
ordens na barra seguinte ou na janela de rebalanceamento após a filtragem por probabilidade define o timing da ordem, o dimensionamento e a restrição de rotação usados quando um sinal do modelo se torna executável. Formula: Signal to order conversion
Calibração da pontuação
A calibração da pontuação mapeia a saída bruta do modelo para faixas de confiança comparáveis, para que o dimensionamento se baseie numa fiabilidade testada. Formula: Probability or rank bucket
a probabilidade cai abaixo do limiar, a classe inverte ou o horizonte de previsão expira
a probabilidade cai abaixo do limiar, a classe inverte ou o horizonte de previsão expira impede que o trade do modelo se torne uma posição discricionária não gerida após o decaimento da previsão. Formula: Prediction no longer supports exposure
Atualização da previsão
As regras de atualização da previsão definem com que frequência a estratégia recalcula as características e substitui decisões obsoletas do modelo. Formula: Re-score on schedule
Expiração do sinal
A expiração do sinal fecha posições quando o horizonte de previsão original decorreu sem o movimento esperado. Formula: Close after forecast horizon
a calibração de probabilidades, os limites de profundidade das árvores e os stops por deriva das características
a calibração de probabilidades, os limites de profundidade das árvores e os stops por deriva das características limita a exposição das posições, a deriva do modelo e o comportamento em real que já não corresponde à amostra de pesquisa validada. Formula: Model and portfolio limits
Deriva das características
A monitorização da deriva das características deteta quando as distribuições de entrada em real se afastaram o suficiente dos dados de treino para invalidar os pressupostos do modelo. Formula: Live distribution versus train
Revisão de sobreajuste
A revisão de sobreajuste compara a complexidade do modelo, a rotação e o número de parâmetros com a quantidade de evidência fora da amostra duradoura. Formula: Complexity versus evidence