Zeitraum: 2024-06-05 bis 2026-06-04
Anzahl Trades: 283
Zusatzdiagnostik
Deflated Sharpe rechnet mit 1 getesteten Varianten (keine Selektion angegeben).
Das ist die automatische Auswertung einer Handelsstrategie. Oben steht das Wichtigste in Kürze — die Details darunter können Sie aufklappen, müssen Sie aber nicht.
- Erwartungswert klar positiv: 34,39 $ je Trade, t = 6,48, BCa-Untergrenze 22,99 $
- Out-of-Sample belegt: WFE-Median 124,5 %, 13 von 15 OOS-Schritten positiv
- Einzige verfehlte Prüfung: Regime-Abdeckung (1 ungetestete Zelle, Bär × Ruhig) - gestaffelte Gesamtwertung lässt die Ampel bewusst GRÜN, weil der Edge inkl. OOS belegt ist
- CUSUM-Ratio 1,60 über Referenz 1,0, Bruch vom 16.07.2024 aber seit 25.11.2025 nachweislich überwunden
- Kelly rechnet 59,69 % - unbrauchbar hoch, maximal 2 % Risiko je Trade umsetzen
Jede Prüfung zählt gleich viel — es gibt keine Gesamtnote, weil jede Gewichtung erfunden wäre. Ein einzelner roter Punkt kann wichtiger sein als zwanzig grüne.
Die Auswertung ist in fünf Kapitel geteilt. Klicken Sie ein Kapitel an, um es zu öffnen — oder springen Sie über die Leiste direkt hin.
Ergebnis & KennzahlenWas hat die Strategie verdient?PF 3,81
1. Performance Dashboard (Overview)
229 Wins | 54 Loss
Avg Loss: $-64,09
Largest Loss: $-513,20
Max Loss-Streak: 3
Vitalwerte im Referenz-Check
Ist-Wert, Referenzbereich und Einordnung auf der Skala (grün schattiert = Normbereich, Marker = Ihr Wert).
| Wert | Gesamt | Action Zones | Referenz | Einordnung | Status |
|---|---|---|---|---|---|
| Profit Factor | 3,81 | 3,81 | >= 1,3 | ✔ | |
| Trade Sharpe Score | 6,48 | 6,48 | >= 2,0 | ✔ | |
| Trade Sortino Score | 9,73 | 9,73 | >= 2,0 | ✔ | |
| Edge Confidence | 100,00 % | 100,00 % | >= 95 | ✔ | |
| Max. Drawdown (vs. MC-99%-Grenze) | 1.039,00 $ | – | <= 2478 $ | ✔ |
2. Scharfschützen-Analyse (MAE / MFE)
MAE (Gewinner): Wie weit liefen Ihre Gewinner im Schnitt ins Minus, bevor sie ins Ziel gingen? (Das ist Ihr optimales Stop-Loss Level)
MFE (Verlierer): Wie weit waren Ihre Verlierer im Schnitt im Plus, bevor sie drehten? (Hier sollten Sie Teilgewinne mitnehmen)
Stop-Loss-Simulation (aus den MAE-Perzentilen Ihrer Gewinner)
| Stop bei | MAE-Perzentil | Gewinner ausgestoppt | Profit simuliert | Δ zu heute |
|---|---|---|---|---|
| $75,00 | p75 | 25,3% | $-429,30 | $-10.160,40 |
| $179,60 | p90 | 10,0% | $3.398,20 | $-6.332,90 |
| $233,60 | p95 | 5,2% | $5.698,30 | $-4.032,80 |
Take-Profit-Kontext: Die Hälfte Ihrer Verlierer war zwischenzeitlich mindestens $9,50 im Plus (75%-Perzentil: $21,00). 0,0% der Verlierer hatten sogar mehr Buchgewinn als Ihr Ø-Gewinn ($57,61) – da lag ein kompletter Winner auf dem Tisch.
Vereinfachte Simulation: Trade endet bei -X, sobald MAE >= X; ohne Slippage und Intrabar-Reihenfolge. Kandidaten stammen aus denselben Daten (In-Sample) - vor Live-Einsatz out-of-sample pruefen.
3. Mathematische Ratios & Zeiten
Optimal: > 2.0 – statistisch belastbar.
Gefährlich: < 1.0 – die Kontokurve ist so volatil, dass der Gewinn vom Zufall nicht unterscheidbar ist.
Grenze: Korrigiert nicht um getestete Varianten – dafür ist die Deflated Sharpe Ratio im Stresstest zuständig.
(μ / σ) · √N
Lesehilfe: Liegt der Sortino deutlich über dem Sharpe, stammen Ihre Schwankungen vor allem aus Gewinn-Ausreißern (gut). Liegen beide nah beieinander, sind Verluste die Hauptquelle der Volatilität.
Optimal: > 2.0. Gefährlich: < 1.0.
(μ / σ_down) · √N
Lesehilfe: Vergleiche ihn mit Ihrem Max. Drawdown. Liegt der Ulcer-Wert nahe am Max-DD, waren Sie fast durchgehend tief unter Wasser (psychologisch zermürbend). Ist er viel kleiner, waren die Drawdowns kurz und wurden schnell aufgeholt. Am wertvollsten ist er im Vergleich zweier Varianten derselben Strategie – z.B. mit und ohne zusätzlichen Stop.
√(Σ(DD²)/N)
Optimal: > 95% – statistisch signifikant.
Gefährlich: Unter 90% ist der Vorsprung vom Rauschen nicht unterscheidbar.
Wichtig: Ein Signifikanzmaß, kein "Beweis" und keine Gewinngarantie – und es korrigiert nicht um die Anzahl getesteter Varianten (dafür: Deflated Sharpe Ratio im Stresstest).
1 − p (einseitiger t-Test)
Muster & beste ZeitfensterWann handelt die Strategie am besten?Zeitmuster
Signifikanz-Filter: Der Test lief ~104 Wochen. Schraffierte Felder haben weniger Trades als das statistische Minimum.
A) Profit-Heatmap (Gewinn/Verlust)
| Tag \ Zeit | 07:00 | 08:00 | 09:00 | 10:00 | 11:00 | 12:00 | 13:00 | 14:00 | 15:00 | 16:00 | 17:00 | 18:00 | 19:00 | 20:00 | 21:00 |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Montag | - | - | - | +$126,705/5 | - | - | - | - | +$1.784,9031/43 | +$503,805/6 | - | - | +$109,009/13 | +$214,002/3 | −$19,600/1 |
| Dienstag | - | - | - | - | - | +$298,304/5 | +$425,209/10 | +$261,409/10 | −$474,407/11 | +$88,604/6 | +$531,007/7 | - | - | - | - |
| Mittwoch | - | - | - | +$557,407/9 | +$462,206/8 | +$169,3015/19 | +$520,6014/17 | +$233,808/10 | −$589,602/4 | +$382,508/9 | +$503,006/7 | - | - | - | - |
| Donnerstag | - | - | - | - | - | - | +$164,807/8 | +$669,2012/12 | +$1.243,4019/23 | +$856,3012/15 | - | - | - | - | - |
| Freitag | - | - | - | - | - | - | - | - | - | - | +$411,2011/12 | +$298,1010/10 | - | - | - |
B) Drawdown-Heatmap (MAE)
Zeigt den durchschnittlichen maximalen Buchverlust (Schmerz) der Trades. Rote Felder bedeuten tiefe Drawdowns.
| Tag \ Zeit | 07:00 | 08:00 | 09:00 | 10:00 | 11:00 | 12:00 | 13:00 | 14:00 | 15:00 | 16:00 | 17:00 | 18:00 | 19:00 | 20:00 | 21:00 |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Montag | - | - | - | −$30,705 | - | - | - | - | −$96,9343 | −$98,926 | - | - | −$38,2313 | −$210,673 | −$27,001 |
| Dienstag | - | - | - | - | - | −$87,205 | −$40,6010 | −$21,6010 | −$160,5911 | −$56,006 | −$38,717 | - | - | - | - |
| Mittwoch | - | - | - | −$104,509 | −$43,508 | −$72,7619 | −$84,6517 | −$63,1010 | −$255,254 | −$49,119 | −$152,297 | - | - | - | - |
| Donnerstag | - | - | - | - | - | - | −$70,508 | −$55,5812 | −$68,1323 | −$110,5315 | - | - | - | - | - |
| Freitag | - | - | - | - | - | - | - | - | - | - | −$25,2512 | −$27,9510 | - | - | - |
D) Saisonalität (Monatliche Stabilität)
Diese Auswertung fasst die Performance der Strategie über alle Kalendermonate zusammen. Um das Ergebnis nicht durch eine ungleiche Datenbasis zu verfälschen, sind die Balken normalisiert. Sie zeigen Ihnen den echten durchschnittlichen statistischen Erwartungswert (Ø Profit pro Monat).
E) Weekly Consistency Tracker
Lese die Boxen von links (älteste) nach rechts (neueste). Zeigt die Stabilität der Strategie über die letzten 52 Handelswochen und visualisiert gefährliche Anhäufungen von Verlustwochen (Losing Streaks).
Marktumfeld & statistische BelastbarkeitKönnen oder Zufall — und in welchem Markt?8/9 Tests ok
F) Markt-Regime-Analyse
Was messen wir? Jeder Trade wird dem Marktregime seines Handelstages zugeordnet: Trend (Referenzindex über/unter der 200-Tage-Linie) und Volatilität (unteres/mittleres/oberes Drittel der letzten 5 Jahre). Warum? Ein Edge, der nur in ruhigen Bullenphasen belegt ist, ist eine Wette auf deren Fortbestand – das sollten Sie wissen, bevor der Markt dreht. Die Regime-Label stammen vom Vortages-Schluss (kein Lookahead).
Referenz: Dow Jones / VIX (Instrument: MYM, aus dem Dateinamen erkannt) | Datenstand: 2026-08-27
| Trend \ Vola | Vola: Ruhig | Vola: Normal | Vola: Stress |
|---|---|---|---|
| Bulle (über 200-Tage-Linie) | +$30,81/Trade97 T | 79,0% | Σ $2.988,30 | +$28,68/Trade112 T | 81,9% | Σ $3.212,00 | +$47,85/Trade14 T | 82,4% | Σ $669,90 |
| Bär (unter 200-Tage-Linie) | ungetestet | +$39,30/Trade23 T | 77,9% | Σ $903,90 | +$52,89/Trade37 T | 84,0% | Σ $1.957,00 |
Zellen zeigen Ø-Profit pro Trade | Anzahl Trades | adjustierte Winrate | Summen-PnL. Schraffiert = unter 20 Trades (nur Tendenz, keine belastbare Aussage). Winrate ist Bayes-adjustiert (Shrinkage zur Basisrate).
5. Monte-Carlo Stresstest (1.000 Durchläufe)
Beim normalen Backtest sehen wir nur eine einzige historische Abfolge Ihrer Trades. Die Simulation baut daraus 1.000 alternative Kontoverläufe – per Block-Bootstrap: Es werden zusammenhängende Blöcke von Trades gezogen, damit die typischen Gewinn- und Verlustserien Ihres Systems erhalten bleiben. (Einzelne Trades wild zu mischen würde genau diese Serien zerstören und das Risiko künstlich schönrechnen.) Lesehilfe: Der Median ist der realistische Erwartungswert; die schlechtesten 5% zeigen, was Sie in einer Pechphase aushalten können müssen. Beides gehört in Ihre Positionsgrößen-Planung – nicht der eine Backtest-Verlauf.
...
...
...
...
6. Quantitativer Stresstest (Details)
Hier prüfen wir mit strengen statistischen Modellen, ob Ihre Ergebnisse auf echtem Können (Edge) basieren oder ob Ihr System nur ein Zufallsprodukt ist.
Referenz-Check: Statistische Belastbarkeit
Ist-Wert, Referenzbereich und Einordnung auf der Skala (grün schattiert = Normbereich, Marker = Ihr Wert).
| Wert | Gesamt | Referenz | Einordnung | Status |
|---|---|---|---|---|
| Edge-Signifikanz (t-Statistik) | 6,48 | >= 2,0 | ✔ | |
| Deflated Sharpe Ratio | 1,00 | >= 0,95 | ✔ | |
| BCa-Untergrenze Ø-Trade | 22,99 $ | > 0 | ✔ | |
| Profit ohne Top-5%-Trades | 6.763,10 $ | > 0 | ✔ | |
| Alterung (Mann-Whitney p) | 0,74 | > 0,05 | ✔ | |
| CUSUM-Drift (Ratio) ▲ Bruch nachweislich überwunden | 1,60 | < 1,0 | ▲ | |
| Verlust-Cluster (Runs p) | 0,51 | > 0,05 | ✔ | |
| Reihenfolge-Glück (Permutation p) | 0,97 | > 0,05 | ✔ | |
| Walk-Forward Efficiency (Median) ▲ Aussagekraft eingeschränkt | 124,50 % | >= 50 | ✔ |
Die ausführlichen Erklärungen zu jedem Wert folgen in den Karten darunter.
Warum ist das wichtig? Wenige Trades oder starke Ausreißer erzeugen schnell einen schönen Backtest ohne echten Edge. Die t-Statistik verrechnet Gewinnhöhe, Streuung und Stichprobengröße zu einer einzigen Belastbarkeits-Zahl.
Interpretation: Grün (t > 2): Der Durchschnittsgewinn ist statistisch belastbar. Rot: Das Ergebnis ist vom Zufall nicht unterscheidbar – sammle mehr Daten, bevor Kapital riskiert wird.
Grenze dieses Tests: Er kennt Ihren Suchaufwand nicht. Ob der Edge auch die Korrektur um alle getesteten Varianten überlebt, prüft die Deflated Sharpe Ratio direkt darunter.
Warum ist das wichtig? Wer 150 Zeitfenster screent, findet immer irgendwo eine gute Kennzahl – reiner Zufall. Die DSR hebt die Messlatte um genau den Sharpe-Wert an, den das beste von 150 Zufalls-Systemen erwartungsgemäß erreicht hätte. Die Messlatte steigt also mit jeder zusätzlich getesteten Variante.
Interpretation: Grün (> 0,95): Der Edge überlebt auch nach Abzug des Suchaufwands. Rot: Die gute Kennzahl ist wahrscheinlich ein Artefakt der vielen getesteten Varianten (Backtest-Overfitting).
Warum ist das wichtig? Trade-Verteilungen sind fast nie normalverteilt (viele kleine Gewinne, wenige große Verluste). Klassische Tests unterschätzen dann das Risiko am linken Rand. Das BCa-Verfahren kommt ohne Normalannahme aus.
Interpretation: Grün (> 0): Selbst am unteren Rand des Intervalls bleibt Ihr Ø-Trade positiv. Rot: Das Intervall schließt die Null ein – ein negativer wahrer Erwartungswert ist statistisch nicht ausgeschlossen.
Warum ist das wichtig? Der häufigste Selbstbetrug im Backtest: Drei, vier Glückstrades (ein News-Spike, ein einmaliger Trend-Tag) tragen den gesamten Gewinn – und genau diese Trades wiederholen sich live nicht zuverlässig. Ein echter Edge muss von der Masse der Trades getragen werden.
Interpretation: Grün (> 0): Der Edge ist breit verteilt – auch ohne die Ausnahme-Trades bleibt das System profitabel. Rot: Der Profit hängt an einer Handvoll Ausreißern. Prüfe, ob diese Trades einem reproduzierbaren Muster folgen (dann bewusst so handeln) oder Zufallstreffer waren (dann ist der Backtest wertlos).
Warum ist das wichtig? Märkte ändern sich (Regime Shift). Systeme verlieren ihren Edge oft schleichend, weil sich die Mikrostruktur des Marktes verändert hat. Dieser Test warnt Sie davor.
Interpretation: Grün: Kein Nachlassen messbar – die jüngere Phase ist gleichwertig oder besser. Rot: Warnsignal! Das System baut messbar ab.
Grenze dieses Tests: Die starre Hälften-Teilung sagt nicht, WANN es kippte – das zeigt der CUSUM-Drift-Detektor darunter mit dem konkreten Trade.
Warum ist das wichtig? Der Alterungs-Test (Hälfte 1 vs. Hälfte 2) ist grob: Ein Edge, der erst in den letzten 20% der Historie stirbt, kann darin untergehen. CUSUM schlägt an dem Punkt Alarm, an dem der strukturelle Bruch beginnt.
Interpretation: Angezeigt wird das Verhältnis der CUSUM-Statistik zur Alarmschwelle (die Schwelle ist auf die Länge Ihrer Historie kalibriert, ~5% Fehlalarmrate). Grün (Ratio < 1): Keine anhaltende Verschlechterung erkennbar. Rot (Ratio ≥ 1): Ab einem bestimmten Trade liegt die Performance systematisch unter dem historischen Schnitt – prüfe, was sich ab diesem Zeitpunkt am Markt oder am Setup geändert hat.
Warum ist das wichtig? Wenn Verluste "geklumpt" auftreten (Verlust-Cluster), zerstört das Ihr Konto viel schneller als isolierte Verluste. Es deutet oft auf eine Anfälligkeit in ganz bestimmten (zusammenhängenden) Marktphasen hin.
Interpretation: Grün: Die Abfolge Ihrer Trades ist gesund und zufällig verteilt. Rot: Ihr System ist anfällig für Cluster-Risiken. Nach einem Verlust steigt die statistische Gefahr, dass direkt der nächste folgt.
Warum ist das wichtig? Derselbe Satz Trades kann je nach Reihenfolge einen harmlosen oder einen brutalen Drawdown erzeugen (Sequence-of-Returns-Risiko). Wenn Ihre historische Reihenfolge außergewöhnlich gnädig war, unterschätzt der Backtest Ihr echtes Risiko.
Interpretation: Grün (p > 0,05): Ihr historischer Drawdown liegt im normalen Bereich zufälliger Reihenfolgen – der Backtest wurde nicht durch eine Glücks-Sequenz geschönt. Rot (p ≤ 0,05): Ihr Drawdown war verdächtig klein; in fast allen anderen Reihenfolgen wäre er tiefer ausgefallen. Plane live mit den Monte-Carlo-Grenzen (Notbremsen-Block), nicht mit dem Backtest-Drawdown.
Walk-Forward & HandelsempfehlungHält die Strategie in ungesehenen Daten?WFE 125%
7. Walk-Forward Efficiency (AI Optimized)
Institutionelle Nested Walk-Forward Optimization (mit 2D-Plateau-Scoring)
Dieser Stresstest nutzt kein statisches Curve-Fitting, sondern eine verschachtelte ("nested") Optimierung. Die KI wandert durch die Historie, isoliert das In-Sample-Fenster und baut eine Matrix aus bis zu 225 Parameter-Kombinationen (Winrate, MAE, Golden Limit & Stop-Overlay aus den MAE-Perzentilen der Gewinner). Anstatt blinde Ausreißer zu wählen, sucht sie das stabilste Plateau, verwirft zu schmale Zeitfenster-Sets (unter ~10% der Trades) und friert diese Parameter ein. Die Zeitfenster werden im Walk-Forward auf Stundenbasis geprüft – das ist robuster bei kurzen Fenstern. Erst danach erfolgt der ungesehene Out-of-Sample-Test (Blind-Test). Angezeigt wird der Median über alle getesteten IS/OOS-Fensterkombinationen – nicht das beste Fenster, denn das wäre Selektions-Bias.
Aussagekraft dieser Walk-Forward-Analyse: EINGESCHRÄNKT
Der WFE-Wert ist nur eingeschränkt belastbar:
- Nur ~2.7 Trades pro Woche. Bei dieser Frequenz enthalten die Stunden-Zellen der rollierenden Fenster zu wenige Trades fuer belastbare Aussagen.
Was für diese Strategie stattdessen zählt: Die Stresstests oben bewerten die Strategie selbst – sie bleiben voll gültig und sind hier das maßgebliche Urteil. Für einen echten Robustheits-Beweis nutze die Walk-Forward-Optimierung in NinjaTrader (Strategie-Parameter je Fenster neu optimieren) und lade das Out-of-Sample-Ergebnis mit gesetzter WFO-Checkbox hoch – das prüft die Strategie dort, wo ihre Stellschrauben wirklich liegen, statt an der Uhrzeit.
Robuste Auswahl: Gezeigt wird der Median aus 11 getesteten IS/OOS-Fensterkombinationen (WFE-Spanne: 89,2% bis 135,3%). Das beste Fenster wird bewusst nicht herausgepickt, da dies die Robustheit systematisch überschätzen würde.
Aktuelle Handelsempfehlung (jüngstes Fenster: 06.12.25 – 04.06.26, 180 Tage)
Einzustellende Parameter: Bann ab: 6 Trades, Schwere: 0.25, Stop: ohne
Stop-Loss: keiner – Original-Exits beibehalten
Gültig bis: 04.07.26 (gerechnet ab dem letzten Trade Ihrer CSV) – spätestens dann neue CSV hochladen und die dann aktuelle Empfehlung übernehmen. Der 30-Tage-Rhythmus ist exakt der Re-Optimierungs-Takt, den der Walk-Forward-Test oben validiert hat. Liegt das Datum bereits in der Vergangenheit, ist Ihre CSV zu alt – direkt neu exportieren und hochladen.
| Tag | Fenster | Trades | Ø/Trade | Winrate | Ø-MAE (Risiko) | PnL |
|---|
Exakte Optimierung: die profitabelsten bis zu X nicht überlappenden, zusammenhängenden Stunden-Blöcke je Tag (Basis: jüngstes Fenster inkl. gewähltem Stop). Tage ohne positives Fenster erscheinen nicht – dort lieber pausieren. Im 30-Minuten-Raster sind einzelne Zellen dünn besetzt: nutze es zur Feinjustierung der Grenzen, die Entscheidung triff im 60er-Raster und mit Blick auf die Trades-Spalte.
Basis sind nur die letzten 180 Tage – die Kennzahlen pro Fenster sind entsprechend grob. Validiert ist das Verfahren (Median-WFE oben), nicht dieses konkrete Fenster-Set.
KI-Gutachten & RisikoAlles in Worten — und wie viel Risiko?Urteil: grün
8. KI-Diagnose & Dynamisches Risikomanagement
Die Kurzfassung steht oben im Cockpit unter „In Klartext". Hier die ausführliche Einordnung – klicken Sie einen Abschnitt an, um ihn zu öffnen:
Datenbasis & Belastbarkeit der Auswertung
Solide Trade-Zahl, aber die Kernzahlen stammen aus einem In-Sample-Backtest.
- Zeitraum 05.06.2024 bis 04.06.2026, 283 Trades, rund 2,7 Trades pro Woche
- DATEN_HERKUNFT: Standard-Backtest, eine feste Parametrisierung, in-sample erzeugt - alle Kennzahlen entsprechend zu diskontieren
- Separates Walk-Forward mit 15 Schritten, 0 leere Schritte, 6.565,10 $ OOS-Summe liefert echten ungesehenen Beleg
- ACTION_ZONES stammen aus 150 getesteten Zellen; DSR fällt dort von 1,0 auf 0,9553 - knapp über der 0,95-Schwelle
- WFO-Aussagekraft selbst als eingeschraenkt markiert: zu wenige Trades je Stundenzelle
- Clusterstruktur unkritisch: n_effektiv 282 von 283, Designeffekt 1,003
Ertragsprofil
Hohe Trefferquote mit ungünstiger Payoff-Asymmetrie - typisches Vielgewinner-Profil.
- Profit Factor 3,81, CI 1,95 bis 12,84 schließt 1 nicht ein
- Trefferquote 80,92 % (CI 76,6 bis 85,11 %), aber avg_win 57,61 $ unter avg_loss 64,09 $ (Ratio 0,90)
- Größter Verlust 513,20 $ entspricht dem 8,01-fachen Durchschnittsverlust - einzelne Ausreißer fressen neun Gewinner
- Max Drawdown 1.039,00 $ deutlich unter der MC-99%-Grenze von 2.478 $
- Psychologisch: max. 18 Gewinner in Folge erzeugen Übermut, ein einzelner -513 $-Trade kippt die Stimmung
- Tail-Konzentration moderat: Top-5-Trades nur 11,2 % des Profits
Statistische Belastbarkeit (der Referenz-Check erklärt)
Acht von neun Laborwerten grün, einzig die CUSUM-Drift steht auf gelb.
- Edge-Signifikanz t = 6,48 gegen Referenz >= 2,0 - klar bestanden
- Deflated Sharpe 1,0 (Action-Zones-Variante 0,9553) gegen Referenz >= 0,95 - Edge überlebt die Deflation
- BCa-Untergrenze 22,99 $ > 0 und Block-Bootstrap-CI 20,64 bis 46,41 $ bestätigt ohne Verteilungsannahme
- Ohne Top-5%-Trades bleiben 6.763,10 $ Profit, Anteil der Top-5 % 30,5 %
- CUSUM-Ratio 1,60 gegen Referenz < 1,0: gelb, mit Sondervermerk Bruch überwunden
- Runs-Test p = 0,5121 und Permutation p = 0,9650 - kein Verlustcluster, kein Reihenfolgeglück
- Sharpe annualisiert 4,588 gegen Zufallsschwelle 2,413 bei 72 Varianten; nötige Backtest-Länge nur 0,4 Jahre
Zeitliche Stabilität
Historische Schwächephase am Anfang, seither klar tragfähiges Niveau.
- Mann-Whitney p = 0,741 - keine Abnutzung der jüngeren Hälfte nachweisbar
- CUSUM-Bruch ab Trade 14 am 16.07.2024, Erholung ab Trade 190 am 25.11.2025
- Phase vor Bruch: 13 Trades mit -36,76 $ Schnitt bei 61,5 % Trefferquote
- Phase seither: 94 Trades mit +52,54 $ Schnitt bei 84,0 % Trefferquote - kein aktueller Abbau
- Wochen-Konsistenz: 92,3 % von 78 Wochen positiv, maximal 1 Verlustwoche in Folge
- Parameterstabilität nur 8 von 15 Schritten identisch (Bann ab 6, Schwere 0,25, Stop ohne) - Bann-Schwelle pendelt zwischen 3 und 9
Marktumfeld & Regime
Der Edge ist im Bullenmarkt breit belegt, eine Regimezelle bleibt ungetestet.
- Bulle × Ruhig 97 Trades, 2.988,30 $; Bulle × Normal 112 Trades, 3.212,00 $ mit Expectancy 28,68 $
- Bär × Stress 37 Trades mit Expectancy 52,89 $ - auch Stressphasen tragen
- Bär × Ruhig mit 0 Trades vollständig ungetestet; Bulle × Stress mit 14 Trades nicht bewertbar
- Konzentration: 33,0 % des Profits in Bulle × Normal, 432 Bullen- gegen 69 Bärentage - faktisch eine Wette auf Fortbestand des Aufwärtsmarkts
- Top-Slot Monday 15:30 mit 1.414,70 $ aus 28 Trades, avg_mae 111,89 $
- Flop-Slot Monday 19:30 nur 34,20 $ aus 9 Trades bei 55,6 % Trefferquote - dünn und kaum tragend
Risiko & Positionsgröße
Kelly ist hier keine handelbare Größe, Deckelung bei 2 % ist Pflicht.
- Kelly_fraction 59,69 % - bei 80,92 % Winrate reagiert die Formel extrem empfindlich auf Schätzfehler; 3 Prozentpunkte weniger Trefferquote halbieren das Ergebnis
- Empfehlung: maximal 2 % Risiko je Trade, konservativ 1 % bis der OOS-Betrieb 30 Trades bestätigt
- Kill-Switch 1: kumulierter Drawdown über 1.994,00 $ (oberes Ende des DD-CI) - System pausieren
- Kill-Switch 2: mehr als 4 Verlusttrades in Folge (historisch max. 3) oder 2 Verlustwochen in Folge (historisch max. 1)
- Einzeltrade-Risiko: größter Verlust 513,20 $ muss in der Positionsgröße abgebildet sein, nicht der Durchschnitt von 64,09 $
- Fehlalarmwahrscheinlichkeit ohne Korrektur 26,5 % bei 6 Tests - nach Korrektur bleiben 3 Tests signifikant
Handlungsplan & Watchlist
Live gehen mit gedeckeltem Risiko, ohne Hard-Stop, mit engem Monitoring.
- 1. Keinen engen Stop einführen. Die Simulation zeigt: Stop bei 75,00 $ (p75 MAE der Gewinner) stoppt 25,3 % der Gewinner aus und dreht das Ergebnis auf -429,30 $, ein Delta von -10.160,40 $. Auch der weite Stop bei 233,60 $ (p95) kostet noch 4.032,80 $. Erfolgskriterium: der Netto-Profit bleibt ohne Stop über 30 $ je Trade.
- 2. Falls ein Katastrophen-Stop aus Broker- oder Margin-Gründen zwingend ist, dann bei mindestens 233,60 $, weil dort nur 5,2 % der Gewinner betroffen sind. Beachten Sie: Diese Zahlen sind In-Sample gerechnet, ohne Slippage und ohne Intrabar-Reihenfolge - vor Live-Einsatz out-of-sample nachrechnen.
- 3. Take-Profit-Idee verwerfen. Nur 3,7 % der Verlierer hatten je einen Buchgewinn über dem Durchschnittsgewinn von 57,61 $, der Median-MFE der Verlierer liegt bei 9,50 $. Ein TP würde also fast nur Gewinner beschneiden.
- 4. Handelszeit auf 07:00 bis 22:00 Mo-Fr belassen, aber Monday 15:30 (1.414,70 $ aus 28 Trades) und Thursday 15:30 (1.016,70 $ aus 14 Trades) als Kernzeit priorisieren. Randslots wie Monday 19:30 mit 34,20 $ aus 9 Trades liefern keinen messbaren Beitrag und binden Kapital.
- 5. Risiko auf 1 % je Trade starten, nach 30 Live-Trades mit positivem Erwartungswert auf maximal 2 % erhöhen. Grund: Kelly von 59,69 % ist bei dieser Trefferquote statistisch nicht belastbar.
- Watchlist Report 1: CUSUM-Ratio (aktuell 1,60). Steigt sie bei Status aktiv statt erholt, sofort Risiko halbieren.
- Watchlist Report 2: Trefferquote gegen das CI 76,6 bis 85,11 %. Ein Abrutschen unter 76,6 % kippt die gesamte Payoff-Rechnung, weil avg_win 57,61 $ kleiner als avg_loss 64,09 $ ist.
- Watchlist Report 3: Regimezelle Bär × Ruhig (aktuell 0 Trades). Erst wenn dort mindestens 20 Trades vorliegen, ist die Abdeckungslücke geschlossen.
Empfohlenes Risiko (Quarter-Kelly)
5,00%
pro Trade
9. Live-Trading Notbremsen (99% CI)
CI steht für Confidence Interval (Konfidenzintervall). Die hier verwendeten 99% CI-Grenzen basieren auf 1.000 Block-Bootstrap-Simulationen Ihrer Strategie – dabei bleiben die typischen Verlust-Serien Ihres Systems erhalten, statt sie durch zufälliges Mischen zu verharmlosen. Sie definieren den Bereich, in dem sich Drawdowns und Verlustserien mit einer Wahrscheinlichkeit von etwa 99% bewegen sollten, sofern Sie mit derselben Logik, demselben Risiko pro Trade und vergleichbaren Marktbedingungen arbeiten.
Max. Drawdown
Worst-Case: Erreicht Ihr Drawdown diese Grenze, ist sofortige Handelsunterbrechung angesagt.
Max. Pechsträhne
Worst-Case: Überschreitet das System diese Verlustserie, veraltet es vermutlich gerade am Markt.
P(Verlustphase)
Einordnung: So wahrscheinlich endet ein beliebiger Abschnitt von 100 Trades netto im Minus – auch wenn das System völlig intakt ist. Eine Verlustphase dieser Größenordnung ist also kein Abschaltgrund, sondern fest einzuplanen. Abgeschaltet wird erst an den beiden Grenzen darüber.
Risk Disclaimer. Das Produkt stellt keine Finanzberatung, Anleitung oder Empfehlung dar, irgendwelche Trades, Investitionen oder Entscheidungen zu treffen oder zu unterlassen. Der bereitgestellte Inhalt ist unpersönlich und nicht auf einen bestimmten Kunden, Händler oder Geschäftskontext zugeschnitten. Es wird dringend empfohlen, vor jeglichen Entscheidungen eine professionelle Finanzberatung einzuholen. Ergebnisse sind nicht garantiert und können individuell variieren. Der Handel beinhaltet erhebliche Risiken, einschließlich des möglichen vollständigen Verlustes Ihrer Investition. Vergangene Marktperformance ist kein verlässlicher Indikator für zukünftige Ergebnisse. Jede Investition erfolgt auf eigenes Risiko, und die volle Verantwortung liegt ausschließlich bei Ihnen.
Automatisierte Handelsstrategien. Unsere automatisierten Handelsstrategien für die NinjaTrader-Handelssoftware dienen ausschließlich Bildungszwecken, dem manuellen Vergleich offener Handelspositionen mit einer Strategie und professionellem Backtesting. Wir empfehlen, diese Strategien in einem Demokonto zu testen, bevor echtes Kapital eingesetzt wird. Die Entscheidung, eine Order zu platzieren, und die Kriterien für deren Eröffnung liegen vollständig in der Verantwortung des Traders. Wir schließen jede Haftung für fehlerhafte oder unerwünschte Positionierungen aus. Da wir Ihre persönliche Hardware- und Softwareumgebung sowie die Qualität zukünftiger Updates von Brokern oder Kurslieferanten nicht beeinflussen können, übernehmen wir keine Haftung für die Funktionalität oder Richtigkeit der angebotenen Handelsstrategien. Prüfen Sie alle vorgeschlagenen Transaktionen sorgfältig selbst.
Risikohinweis. Der Handel mit Futures und Kryptowährungen birgt erhebliche Risiken und ist nicht für jeden Anleger geeignet. Es besteht die Möglichkeit, die gesamte ursprüngliche Investition oder mehr zu verlieren. Nur Risikokapital sollte für den Handel eingesetzt werden – also Kapital, dessen Verlust keine Beeinträchtigung der finanziellen Sicherheit oder des Lebensstils verursacht. Nur Anleger mit ausreichend Risikokapital sollten den Handel in Betracht ziehen. Die Wertentwicklung in der Vergangenheit ist kein verlässlicher Hinweis auf zukünftige Ergebnisse.
Hypothetical Performance Disclosure (CFTC Rule 4.41 / NFA). Hypothetical performance results have many inherent limitations, some of which are described below. No representation is being made that any account will or is likely to achieve profits or losses similar to those shown; in fact, there are frequently sharp differences between hypothetical performance results and the actual results subsequently achieved by any particular trading program. One of the limitations of hypothetical performance results is that they are generally prepared with the benefit of hindsight. In addition, hypothetical trading does not involve financial risk, and no hypothetical trading record can completely account for the impact of financial risk of actual trading. For example, the ability to withstand losses or to adhere to a particular trading program in spite of trading losses are material points which can also adversely affect actual trading results. There are numerous other factors related to the markets in general or to the implementation of any specific trading program which cannot be fully accounted for in the preparation of hypothetical performance results and all of which can adversely affect actual trading results.
Deutsche Übersetzung (unverbindlich): Hypothetische Performance-Ergebnisse unterliegen zahlreichen systembedingten Einschränkungen. Es wird nicht zugesichert, dass ein Konto Gewinne oder Verluste erzielt, die den dargestellten ähneln; tatsächliche und hypothetische Ergebnisse weichen häufig deutlich voneinander ab. Hypothetische Ergebnisse werden im Nachhinein erstellt, sind nicht mit finanziellem Risiko verbunden und können dessen Auswirkungen im realen Handel nicht vollständig abbilden – etwa die Fähigkeit, Verluste zu verkraften oder trotz Verlusten an einer Strategie festzuhalten. Zahlreiche weitere Markt- und Umsetzungsfaktoren können reale Ergebnisse nachteilig beeinflussen und sind in hypothetischen Berechnungen nicht vollständig berücksichtigt.