Aller au contenu principal
🎮

DQN · ML Arena

Machine Learning ML Arena

Deep Q-Network — apprentissage par renforcement profond. Apprend à trader par essai-erreur comme un joueur de jeu vidéo.

Vous avez votre propre stratégie ? Quick Check gratuit, sans compte — un verdict défavorable reste un résultat.

Chargement des données...

À propos de DQN · ML Arena

DQN (Deep Q-Network) est un agent de reinforcement learning (RL) qui apprend à trader les cryptomonnaies en interagissant directement avec l'environnement de marché — comme un joueur de jeu vidéo qui apprend par essai-erreur. L'agent DQN ne suit pas de règles prédéfinies : il découvre sa propre stratégie optimale en maximisant une récompense (le profit ajusté au risque). C'est le seul modèle de l'arène ML qui apprend une politique d'action complète (quand acheter, vendre, combien) plutôt que juste la direction du prix.

Comment ça fonctionne

L'agent observe un état de marché (20 features : prix, RSI, MACD, volume, position actuelle, PnL en cours). Choisit une action parmi 5 : acheter 25%, acheter 50%, ne rien faire, vendre 25%, vendre 50%. Reçoit une récompense = variation du Sharpe ratio incrémental. Le réseau de neurones (3 couches, 256-128-64) apprend à prédire la Q-value (valeur future attendue) de chaque action. Experience replay buffer de 100K transitions. Epsilon-greedy exploration (5%).

Signaux utilisés

Q-values pour chaque action (acheter/vendre/attendre). Politique apprise par interaction avec le marché. 20 features d'état (prix, indicateurs, position). Experience replay (mémoire de 100K transitions). Epsilon-greedy exploration (5% de trades aléatoires pour découvrir de nouvelles stratégies).

Niveau de risque

Élevé

Points forts

Apprend sa propre stratégie optimale (pas de règles imposées par l'humain). Optimise directement le trading (actions) et pas juste la prédiction de prix. S'adapte aux conditions de marché changeantes. Découvre des patterns d'action que les humains ne trouvent pas.

Points faibles

Instabilité de l'entraînement RL (convergence non garantie). Comportement parfois erratique (boîte noire). Nécessite énormément de données d'interaction. L'environnement de marché non-stationnaire complique l'apprentissage. L'exploration aléatoire (5%) coûte de l'argent.

Caractéristiques

  • Catégorie: ML
  • Arène: Arène Machine Learning
  • Simulation en temps réel 24/7
  • Données live Binance

Parcours partenaire TradingView

Pas de TradingView ? Créez le premier compte web ici.

Si vous n’avez jamais créé de compte TradingView, commencez ici (contexte coupon 15 $ sur un plan web). Déjà un compte ? Bouton compte existant — aucun lien partenaire. Tester une stratégie reste une étape Lab gratuite, à part.

01 · AccountPremier compte ou compte existant
02 · LabMesurer avant de se fier au Pine
03 · ReviewColler le Pine survivant exact

Contexte coupon partenaire · Transparence affiliation : Strategy Arena peut recevoir une commission si un nouvel utilisateur achète ensuite un abonnement web éligible. L'attribution partenaire est réservée aux nouveaux utilisateurs et aux achats web. Créer un compte ne valide aucune stratégie ; le code de stratégie exact reste soumis à la preuve. Ouvrir ce parcours ou créer un compte n’est pas une commission confirmée. Les achats app desktop/mobile sont exclus par les règles partenaires. Stripe Builder/Operator est une capacité Lab séparée — jamais un meilleur holdout.

Explorez les 75+ stratégies de trading dans 4 arènes

🏟️ Voir toutes les stratégies
← Retour à l'arène