Dateiname: 20260829-MNQ.csv
Zeitraum: 2023-09-01 bis 2026-08-28
Anzahl Trades: 598

Zusatzdiagnostik

Unabhängigkeit der Trades
Design-Effekt 1,54
Ø 2 Trades je Signal, ICC 0.543. Effektive Stichprobe 388. Alle p-Werte sind um den Faktor 1.242 zu optimistisch.
Fenster-Konsistenz
86 von 110 positiv
Vorzeichentest p = 0,000. Das Ergebnis verteilt sich über mehrere Perioden. Quelle: aus Datumsluecken geschaetzt (unsicher).
Konfidenzintervall (Block-Bootstrap)
35,24 bis 88,04 $
Blocklänge 7 — respektiert Verlust-Cluster, anders als das iid-Bootstrap-Intervall oben.
Trennschärfe
50 Signale nötig
Vorhanden: 299. Für einen gesicherten Nachweis bräuchte es das 0,2-fache.

Deflated Sharpe rechnet mit 1 getesteten Varianten (keine Selektion angegeben).

Das ist die automatische Auswertung einer Handelsstrategie. Oben steht das Wichtigste in Kürze — die Details darunter können Sie aufklappen, müssen Sie aber nicht.

Gesamturteil
Belastbarer Vorteil
Alle Kernkriterien sind erfüllt — die Details stehen in den Kapiteln.
In Klartext

Der Edge ist statistisch breit belegt: t = 5,97, DSR = 1,0 (Action-Zones 0,9941), BCa-Untergrenze des Ø-Trades bei 20,13 $ und eine Walk-Forward Efficiency von 97,35 % mit 17 von 20 positiven OOS-Schritten. Die Ampel steht GRÜN, OBWOHL genau eine Einzelprüfung klar verfehlt wurde: Der Runs-Test auf Verlust-Cluster mit p = 0,0017 (Referenz > 0,05) ist rot — der Edge selbst inklusive Out-of-Sample-Beleg bleibt davon unberührt, deshalb kippt diese einzelne Robustheitsprüfung das Gesamturteil bewusst nicht. Weitere Schwachstellen: der Design-Effekt von 1,543 (effektive Stichprobe nur 388 statt 598 Trades, p-Werte um Faktor 1,242 zu optimistisch) und das ungetestete Regime Bär × Ruhig mit 0 Trades. Wichtigste Handlung: Risiko auf maximal 2 % pro Trade begrenzen und die Cluster-Neigung über einen Tagesverlust-Deckel absichern, nicht über einen engen Stop.

Netto-Ergebnis
$18.530,20
Gesamtergebnis über den ganzen Zeitraum.
Profit Factor
1,87
Pro 1 $ Verlust kamen 1,87 $ zurück. Über 1,5 = gut.
Trefferquote
68,23%
Anteil der Trades, die im Gewinn endeten.
Max. Rückschlag
$2.943,60
Tiefster Konto-Einbruch zwischendurch. Kleiner = besser.
10 von 12Prüfungen bestanden
Offen: Verlust-Cluster (Runs-Test), Unabhaengigkeit der Trades
✓ Zufallsschwelle
Ertrag3/3
Robustheit3/3
Stabilität4/5

Jede Prüfung zählt gleich viel — es gibt keine Gesamtnote, weil jede Gewichtung erfunden wäre. Ein einzelner roter Punkt kann wichtiger sein als zwanzig grüne.

Nächster Schritt: aktive Zeitfenster und Parameter laut Kapitel „Walk-Forward" — Empfehlung gültig bis 12.10.26.

Die Auswertung ist in fünf Kapitel geteilt. Klicken Sie ein Kapitel an, um es zu öffnen — oder springen Sie über die Leiste direkt hin.

Ergebnis & KennzahlenWas hat die Strategie verdient?PF 1,87
Kurz gesagt: Dieses Kapitel zeigt die vollständige Leistungsübersicht: die Kernzahlen aus dem Cockpit noch einmal im Detail, dazu wie oft gehandelt wurde, wie lange Gewinn- und Verlustserien liefen und wie das Chance-Risiko-Verhältnis aussieht – jede Kennzahl kurz erklärt.

1. Performance Dashboard (Overview)

Total Net Profit
$18.530,20
Gross Win: $39.856,20  |  Loss: $-21.326,00
Profit Factor
1,87
Gross Profit / Gross Loss
Max. Drawdown
$2.943,60
Höchster historischer Kontoeinbruch
Win Rate / Trades
68,23%
Aus 598 Trades gesamt
408 Wins | 190 Loss
Avg. Trade (Expectancy)
$30,99
Durchschnittlicher Wert jedes Trades (inklusive Verlust-Trades).
Risk / Reward Ratio
0,87
Avg Win: $97,69
Avg Loss: $-112,24
Extrem-Trades (Largest)
Grenzwerte
Largest Win: $362,40
Largest Loss: $-258,60
Consecutive Streaks
Serien
Max Win-Streak: 19
Max Loss-Streak: 5

Vitalwerte im Referenz-Check

Ist-Wert, Referenzbereich und Einordnung auf der Skala (grün schattiert = Normbereich, Marker = Ihr Wert).

WertGesamtAction ZonesReferenzEinordnungStatus
Profit Factor1,871,90>= 1,3
Trade Sharpe Score5,976,07>= 2,0
Trade Sortino Score8,058,21>= 2,0
Edge Confidence100,00 %100,00 %>= 95
Max. Drawdown (vs. MC-99%-Grenze)2.943,60 $<= 3474 $

2. Scharfschützen-Analyse (MAE / MFE)

MAE (Gewinner): Wie weit liefen Ihre Gewinner im Schnitt ins Minus, bevor sie ins Ziel gingen? (Das ist Ihr optimales Stop-Loss Level)
MFE (Verlierer): Wie weit waren Ihre Verlierer im Schnitt im Plus, bevor sie drehten? (Hier sollten Sie Teilgewinne mitnehmen)

Ø MAE der Gewinner (Stop-Loss)
$61,79
Das ist der durchschnittliche "Schmerz", den Ihre funktionierenden Trades ertragen mussten.
Ø MFE der Verlierer (Take-Profit)
$47,81
So viel Geld lag im Schnitt auf dem Tisch, bevor der Trade doch noch in den Stop-Loss gelaufen ist.

Stop-Loss-Simulation (aus den MAE-Perzentilen Ihrer Gewinner)

Stop beiMAE-PerzentilGewinner ausgestopptProfit simuliertΔ zu heute
$99,00p7525,2%$9.401,40$-9.128,80
$166,30p9010,0%$13.606,50$-4.923,70
$205,60p955,1%$15.950,20$-2.580,00

Take-Profit-Kontext: Die Hälfte Ihrer Verlierer war zwischenzeitlich mindestens $46,00 im Plus (75%-Perzentil: $62,00). 0,0% der Verlierer hatten sogar mehr Buchgewinn als Ihr Ø-Gewinn ($97,69) – da lag ein kompletter Winner auf dem Tisch.

Vereinfachte Simulation: Trade endet bei -X, sobald MAE >= X; ohne Slippage und Intrabar-Reihenfolge. Kandidaten stammen aus denselben Daten (In-Sample) - vor Live-Einsatz out-of-sample pruefen.

3. Mathematische Ratios & Zeiten

Trade Sharpe Score
5,9680
Rendite-Risiko-Verhältnis Ihrer Einzeltrades, skaliert mit der Wurzel der Trade-Anzahl (√N). Der Wert entspricht damit der t-Statistik und wächst mit mehr Trades – er misst also die Verlässlichkeit des Edges, nicht die Renditehöhe.

Optimal: > 2.0 – statistisch belastbar.
Gefährlich: < 1.0 – die Kontokurve ist so volatil, dass der Gewinn vom Zufall nicht unterscheidbar ist.
Grenze: Korrigiert nicht um getestete Varianten – dafür ist die Deflated Sharpe Ratio im Stresstest zuständig.
(μ / σ) · √N
Trade Sortino Score
8,0478
Wie der Sharpe Score, aber es zählen nur die Abwärtsschwankungen – starke Gewinne werden nicht als "Risiko" bestraft. Ebenfalls √N-skaliert und damit direkt mit dem Sharpe Score vergleichbar.

Lesehilfe: Liegt der Sortino deutlich über dem Sharpe, stammen Ihre Schwankungen vor allem aus Gewinn-Ausreißern (gut). Liegen beide nah beieinander, sind Verluste die Hauptquelle der Volatilität.
Optimal: > 2.0. Gefährlich: < 1.0.
(μ / σ_down) · √N
Ulcer-like Score
865,7261
Der Magengeschwür-Index: misst nicht nur wie tief Ihre Drawdowns sind, sondern auch wie lange sie andauern. Der Wert ist in Dollar und hängt von Ihrer Positionsgröße ab – deshalb bewusst ohne Ampel.

Lesehilfe: Vergleiche ihn mit Ihrem Max. Drawdown. Liegt der Ulcer-Wert nahe am Max-DD, waren Sie fast durchgehend tief unter Wasser (psychologisch zermürbend). Ist er viel kleiner, waren die Drawdowns kurz und wurden schnell aufgeholt. Am wertvollsten ist er im Vergleich zweier Varianten derselben Strategie – z.B. mit und ohne zusätzlichen Stop.
√(Σ(DD²)/N)
Edge Confidence
100,00%
Berechnet als 1 − p-Wert des einseitigen t-Tests: Wie unwahrscheinlich wäre Ihr Ergebnis, wenn das System in Wahrheit keinen Edge hätte?

Optimal: > 95% – statistisch signifikant.
Gefährlich: Unter 90% ist der Vorsprung vom Rauschen nicht unterscheidbar.
Wichtig: Ein Signifikanzmaß, kein "Beweis" und keine Gewinngarantie – und es korrigiert nicht um die Anzahl getesteter Varianten (dafür: Deflated Sharpe Ratio im Stresstest).
1 − p (einseitiger t-Test)
Muster & beste ZeitfensterWann handelt die Strategie am besten?Zeitmuster
Kurz gesagt: Hier sehen Sie, an welchen Wochentagen und zu welchen Uhrzeiten die Strategie am besten (grün) oder am schlechtesten (rot) lief – nützlich, um Ihre Handelszeiten sinnvoll einzugrenzen.

Signifikanz-Filter: Der Test lief ~156 Wochen. Schraffierte Felder haben weniger Trades als das statistische Minimum.

A) Profit-Heatmap (Gewinn/Verlust)

Tag \ Zeit07:0008:0009:0010:0011:0012:0013:0014:0015:0016:0017:0018:0019:0020:0021:00
Montag--+$1.142,2018/28----+$1.143,2014/18+$1.885,6051/74----+$935,6017/24-
Dienstag--------+$17,8042/72+$1.212,0022/30-+$330,0014/20+$149,0012/20+$276,2012/18+$25,807/12
Mittwoch--------+$587,0049/80-+$1.047,2015/18-+$486,809/12--
Donnerstag---+$124,007/10+$517,206/8-------+$1.408,0023/30--
Freitag-------+$1.292,0019/30-+$3.346,2047/68+$2.604,4024/26----

B) Drawdown-Heatmap (MAE)

Zeigt den durchschnittlichen maximalen Buchverlust (Schmerz) der Trades. Rote Felder bedeuten tiefe Drawdowns.

Tag \ Zeit07:0008:0009:0010:0011:0012:0013:0014:0015:0016:0017:0018:0019:0020:0021:00
Montag--−$109,8228----−$71,7218−$82,0974----−$112,0024-
Dienstag--------−$92,3672−$83,5730-−$82,4020−$111,8020−$87,6118−$105,3312
Mittwoch--------−$83,0180-−$97,1718-−$72,9212--
Donnerstag---−$71,6010−$43,388-------−$95,0030--
Freitag-------−$86,2030-−$67,2668−$47,1226----

D) Saisonalität (Monatliche Stabilität)

Diese Auswertung fasst die Performance der Strategie über alle Kalendermonate zusammen. Um das Ergebnis nicht durch eine ungleiche Datenbasis zu verfälschen, sind die Balken normalisiert. Sie zeigen Ihnen den echten durchschnittlichen statistischen Erwartungswert (Ø Profit pro Monat).

Jan
Aggregierter Jan+$1.262,6071% Winrate | 34 Trades
Feb
Aggregierter Feb+$828,6059% Winrate | 44 Trades
Mär
Aggregierter Mär+$337,2064% Winrate | 58 Trades
Apr
Aggregierter Apr+$3.280,6075% Winrate | 64 Trades
Mai
Aggregierter Mai+$1.212,0062% Winrate | 60 Trades
Jun
Aggregierter Jun+$2.557,4075% Winrate | 36 Trades
Jul
Aggregierter Jul+$2.475,8073% Winrate | 52 Trades
Aug
Aggregierter Aug+$3.361,8074% Winrate | 62 Trades
Sep
Aggregierter Sep+$2.684,4076% Winrate | 46 Trades
Okt
Aggregierter Okt+$365,6061% Winrate | 54 Trades
Nov
Aggregierter Nov$-707,0060% Winrate | 50 Trades
Dez
Aggregierter Dez+$871,2071% Winrate | 38 Trades

E) Weekly Consistency Tracker

Lese die Boxen von links (älteste) nach rechts (neueste). Zeigt die Stabilität der Strategie über die letzten 52 Handelswochen und visualisiert gefährliche Anhäufungen von Verlustwochen (Losing Streaks).

Woche ab 04.08.2025$-94,4050% Winrate | 4 Trades
Woche ab 11.08.2025+$254,6075% Winrate | 4 Trades
Woche ab 18.08.2025+$361,60100% Winrate | 4 Trades
Woche ab 25.08.2025+$63,4083% Winrate | 6 Trades
Woche ab 01.09.2025+$367,4083% Winrate | 6 Trades
Woche ab 08.09.2025+$50,6050% Winrate | 4 Trades
Woche ab 15.09.2025+$363,60100% Winrate | 4 Trades
Woche ab 29.09.2025$-44,8050% Winrate | 8 Trades
Woche ab 06.10.2025+$55,4050% Winrate | 6 Trades
Woche ab 13.10.2025+$725,2088% Winrate | 8 Trades
Woche ab 20.10.2025$-142,4050% Winrate | 4 Trades
Woche ab 27.10.2025+$465,60100% Winrate | 4 Trades
Woche ab 03.11.2025$-641,0040% Winrate | 10 Trades
Woche ab 10.11.2025+$432,0080% Winrate | 10 Trades
Woche ab 17.11.2025+$902,20100% Winrate | 8 Trades
Woche ab 24.11.2025$-501,200% Winrate | 2 Trades
Woche ab 01.12.2025+$531,60100% Winrate | 4 Trades
Woche ab 08.12.2025$-262,200% Winrate | 2 Trades
Woche ab 15.12.2025+$342,0070% Winrate | 10 Trades
Woche ab 29.12.2025+$317,80100% Winrate | 2 Trades
Woche ab 05.01.2026$-259,200% Winrate | 2 Trades
Woche ab 12.01.2026+$360,4083% Winrate | 6 Trades
Woche ab 19.01.2026+$157,80100% Winrate | 2 Trades
Woche ab 02.02.2026$-288,0060% Winrate | 10 Trades
Woche ab 09.02.2026+$660,0070% Winrate | 10 Trades
Woche ab 16.02.2026+$217,6050% Winrate | 4 Trades
Woche ab 23.02.2026+$108,8050% Winrate | 2 Trades
Woche ab 02.03.2026$-667,4050% Winrate | 14 Trades
Woche ab 09.03.2026$-37,6050% Winrate | 6 Trades
Woche ab 16.03.2026+$64,2063% Winrate | 8 Trades
Woche ab 23.03.2026+$502,40100% Winrate | 6 Trades
Woche ab 30.03.2026+$402,6075% Winrate | 4 Trades
Woche ab 06.04.2026+$108,8050% Winrate | 2 Trades
Woche ab 13.04.2026+$517,60100% Winrate | 4 Trades
Woche ab 20.04.2026+$153,6050% Winrate | 4 Trades
Woche ab 27.04.2026$-243,6067% Winrate | 6 Trades
Woche ab 04.05.2026+$400,60100% Winrate | 4 Trades
Woche ab 11.05.2026+$562,0070% Winrate | 10 Trades
Woche ab 18.05.2026$-461,4036% Winrate | 14 Trades
Woche ab 01.06.2026$-392,4025% Winrate | 4 Trades
Woche ab 08.06.2026+$358,6075% Winrate | 4 Trades
Woche ab 15.06.2026+$108,8050% Winrate | 2 Trades
Woche ab 22.06.2026+$49,4067% Winrate | 6 Trades
Woche ab 29.06.2026+$266,60100% Winrate | 4 Trades
Woche ab 06.07.2026+$673,4083% Winrate | 6 Trades
Woche ab 13.07.2026+$240,6075% Winrate | 4 Trades
Woche ab 20.07.2026+$280,0070% Winrate | 10 Trades
Woche ab 27.07.2026+$79,2063% Winrate | 8 Trades
Woche ab 03.08.2026+$689,2088% Winrate | 8 Trades
Woche ab 10.08.2026$-259,200% Winrate | 2 Trades
Woche ab 17.08.2026+$307,6075% Winrate | 4 Trades
Woche ab 24.08.2026+$229,0050% Winrate | 10 Trades
Hoher Verlust
Hoher Gewinn
Marktumfeld & statistische BelastbarkeitKönnen oder Zufall — und in welchem Markt?7/9 Tests ok
Kurz gesagt: Von 9 strengen Prüfungen sind 7 bestanden. Je mehr bestanden sind, desto eher sind die Gewinne echtes Können und nicht bloß Zufall. Jede Prüfung ist darunter einzeln in Alltagssprache erklärt.

F) Markt-Regime-Analyse

Was messen wir? Jeder Trade wird dem Marktregime seines Handelstages zugeordnet: Trend (Referenzindex über/unter der 200-Tage-Linie) und Volatilität (unteres/mittleres/oberes Drittel der letzten 5 Jahre). Warum? Ein Edge, der nur in ruhigen Bullenphasen belegt ist, ist eine Wette auf deren Fortbestand – das sollten Sie wissen, bevor der Markt dreht. Die Regime-Label stammen vom Vortages-Schluss (kein Lookahead).
Referenz: Nasdaq-100 / VXN (Instrument: MNQ, aus dem Dateinamen erkannt)  |  Datenstand: 2026-08-27

Trend \ VolaVola: RuhigVola: NormalVola: Stress
Bulle (über 200-Tage-Linie)+$21,92/Trade206 T | 67,6% | Σ $4.515,40+$29,27/Trade224 T | 65,5% | Σ $6.557,60+$37,64/Trade108 T | 69,9% | Σ $4.065,20
Bär (unter 200-Tage-Linie)ungetestet+$18,96/Trade18 T | 67,6% | Σ $341,20+$72,64/Trade42 T | 77,0% | Σ $3.050,80

Zellen zeigen Ø-Profit pro Trade | Anzahl Trades | adjustierte Winrate | Summen-PnL. Schraffiert = unter 20 Trades (nur Tendenz, keine belastbare Aussage). Winrate ist Bayes-adjustiert (Shrinkage zur Basisrate).

Ungetestete Regimes: Bär × Ruhig. Für diese Marktphasen gibt es keine Belege – weder positive noch negative. Das ist kein Freibrief: Plane für solche Phasen reduziertes Risiko oder eine Handelspause ein, bis Daten vorliegen.
Regime-Konzentration: 35,4% des Gesamtprofits stammen aus der Zelle Bulle × Normal. Je höher dieser Wert, desto stärker ist Ihr System eine Wette darauf, dass genau dieses Marktumfeld anhält.
Schwächstes belastbar getestetes Regime: Bulle × Ruhig mit +$21,92/Trade aus 206 Trades. Negativ heißt: In dieser Marktphase verliert das System nachweislich – dort nicht handeln oder Risiko drosseln.

5. Monte-Carlo Stresstest (1.000 Durchläufe)

Beim normalen Backtest sehen wir nur eine einzige historische Abfolge Ihrer Trades. Die Simulation baut daraus 1.000 alternative Kontoverläufe – per Block-Bootstrap: Es werden zusammenhängende Blöcke von Trades gezogen, damit die typischen Gewinn- und Verlustserien Ihres Systems erhalten bleiben. (Einzelne Trades wild zu mischen würde genau diese Serien zerstören und das Risiko künstlich schönrechnen.) Lesehilfe: Der Median ist der realistische Erwartungswert; die schlechtesten 5% zeigen, was Sie in einer Pechphase aushalten können müssen. Beides gehört in Ihre Positionsgrößen-Planung – nicht der eine Backtest-Verlauf.

Median Profit:
...
Schlechteste 5%:
...
Median Max Drawdown:
...
Schlechteste 5%:
...

6. Quantitativer Stresstest (Details)

Hier prüfen wir mit strengen statistischen Modellen, ob Ihre Ergebnisse auf echtem Können (Edge) basieren oder ob Ihr System nur ein Zufallsprodukt ist.

Referenz-Check: Statistische Belastbarkeit

Ist-Wert, Referenzbereich und Einordnung auf der Skala (grün schattiert = Normbereich, Marker = Ihr Wert).

WertGesamtReferenzEinordnungStatus
Edge-Signifikanz (t-Statistik)5,97>= 2,0
Deflated Sharpe Ratio1,00>= 0,95
BCa-Untergrenze Ø-Trade20,13 $> 0
Profit ohne Top-5%-Trades12.373,20 $> 0
Alterung (Mann-Whitney p)0,23> 0,05
CUSUM-Drift (Ratio)
▲ Bruch nachweislich überwunden
2,19< 1,0
Verlust-Cluster (Runs p)0,00> 0,05
Reihenfolge-Glück (Permutation p)1,00> 0,05
Walk-Forward Efficiency (Median)
▲ Aussagekraft eingeschränkt
97,35 %>= 50

Die ausführlichen Erklärungen zu jedem Wert folgen in den Karten darunter.

Der Edge-Nachweis (Student's t-Test)
t = μ / (σ / √N) — einseitig, t-Verteilung
Was messen wir? Ob Ihr Durchschnittsgewinn pro Trade weit genug von Null entfernt ist, um kein Zufallsprodukt zu sein. Der Test ist einseitig (uns interessiert nur "besser als Null") und nutzt die t-Verteilung – bei wenigen Trades bewusst konservativer als die Normalverteilung.
Warum ist das wichtig? Wenige Trades oder starke Ausreißer erzeugen schnell einen schönen Backtest ohne echten Edge. Die t-Statistik verrechnet Gewinnhöhe, Streuung und Stichprobengröße zu einer einzigen Belastbarkeits-Zahl.
Interpretation: Grün (t > 2): Der Durchschnittsgewinn ist statistisch belastbar. Rot: Das Ergebnis ist vom Zufall nicht unterscheidbar – sammle mehr Daten, bevor Kapital riskiert wird.
Grenze dieses Tests: Er kennt Ihren Suchaufwand nicht. Ob der Edge auch die Korrektur um alle getesteten Varianten überlebt, prüft die Deflated Sharpe Ratio direkt darunter.
1. Gesamt-Historie
5,9700
Diagnose: Ihr System zeigt einen klaren, statistisch nachweisbaren Marktvorteil (Edge).
Die Overfitting-Bremse (Deflated Sharpe Ratio)
DSR = Φ((SR − SR*) · √(N−1) / √(1 − γ₃SR + ((γ₄−1)/4)·SR²))
Was messen wir? Die Deflated Sharpe Ratio (Bailey & López de Prado) prüft, ob Ihre Sharpe Ratio auch dann signifikant bleibt, wenn man die Schiefe und die fetten Ränder (Kurtosis) Ihrer Trade-Verteilung UND die Anzahl der getesteten Varianten berücksichtigt.
Warum ist das wichtig? Wer 150 Zeitfenster screent, findet immer irgendwo eine gute Kennzahl – reiner Zufall. Die DSR hebt die Messlatte um genau den Sharpe-Wert an, den das beste von 150 Zufalls-Systemen erwartungsgemäß erreicht hätte. Die Messlatte steigt also mit jeder zusätzlich getesteten Variante.
Interpretation: Grün (> 0,95): Der Edge überlebt auch nach Abzug des Suchaufwands. Rot: Die gute Kennzahl ist wahrscheinlich ein Artefakt der vielen getesteten Varianten (Backtest-Overfitting).
1. Gesamt-Historie
1,0000
Diagnose: Der Edge überlebt die Deflationierung: Auch nach Korrektur um Schiefe, Kurtosis und die Anzahl getesteter Varianten bleibt die Sharpe Ratio signifikant.
Der Verteilungs-Check (BCa Bootstrap-Intervall)
Untere Grenze des 95% BCa-Bootstrap-Intervalls (2.000 Resamples)
Was messen wir? Wir ziehen 2.000 Bootstrap-Stichproben aus Ihren Trades und berechnen das bias-korrigierte Konfidenzintervall (BCa) für den durchschnittlichen Trade. Angezeigt wird die untere Grenze in Dollar.
Warum ist das wichtig? Trade-Verteilungen sind fast nie normalverteilt (viele kleine Gewinne, wenige große Verluste). Klassische Tests unterschätzen dann das Risiko am linken Rand. Das BCa-Verfahren kommt ohne Normalannahme aus.
Interpretation: Grün (> 0): Selbst am unteren Rand des Intervalls bleibt Ihr Ø-Trade positiv. Rot: Das Intervall schließt die Null ein – ein negativer wahrer Erwartungswert ist statistisch nicht ausgeschlossen.
1. Gesamt-Historie
20,1300
Diagnose: Robust: Selbst die untere Grenze des 95%-Bootstrap-Intervalls liegt über Null – der positive Erwartungswert hängt nicht an der Normalverteilungs-Annahme.
Der Ausreißer-Check (Profit ohne Top-5%-Trades)
Netto-Profit ohne die besten 5% der Trades
Was messen wir? Wir entfernen die profitabelsten 5% Ihrer Trades und schauen, was übrig bleibt. Angezeigt wird der verbleibende Netto-Profit in Dollar.
Warum ist das wichtig? Der häufigste Selbstbetrug im Backtest: Drei, vier Glückstrades (ein News-Spike, ein einmaliger Trend-Tag) tragen den gesamten Gewinn – und genau diese Trades wiederholen sich live nicht zuverlässig. Ein echter Edge muss von der Masse der Trades getragen werden.
Interpretation: Grün (> 0): Der Edge ist breit verteilt – auch ohne die Ausnahme-Trades bleibt das System profitabel. Rot: Der Profit hängt an einer Handvoll Ausreißern. Prüfe, ob diese Trades einem reproduzierbaren Muster folgen (dann bewusst so handeln) oder Zufallstreffer waren (dann ist der Backtest wertlos).
1. Gesamt-Historie
12.373,2000
Diagnose: Breit getragener Edge: Auch ohne die besten 5% der Trades bleibt das System profitabel – der Gewinn hängt nicht an einzelnen Glückstreffern.
Der Alterungs-Test (Mann-Whitney U)
U = n₁n₂ + (n₁(n₁+1)/2) - R₁
Was messen wir? Wir halbieren Ihre Trade-Historie (ältere vs. jüngere Hälfte) und vergleichen die Verteilungen. Der Test ist einseitig: Er schlägt nur an, wenn die jüngere Hälfte signifikant SCHLECHTER ist – eine Verbesserung gilt korrekt nicht als "Alterung".
Warum ist das wichtig? Märkte ändern sich (Regime Shift). Systeme verlieren ihren Edge oft schleichend, weil sich die Mikrostruktur des Marktes verändert hat. Dieser Test warnt Sie davor.
Interpretation: Grün: Kein Nachlassen messbar – die jüngere Phase ist gleichwertig oder besser. Rot: Warnsignal! Das System baut messbar ab.
Grenze dieses Tests: Die starre Hälften-Teilung sagt nicht, WANN es kippte – das zeigt der CUSUM-Drift-Detektor darunter mit dem konkreten Trade.
1. Gesamt-Historie
0,2298
Diagnose: Keine Alterung erkennbar: Die jüngere Phase performt statistisch gleichwertig zur älteren.
Der Drift-Detektor (CUSUM)
S(t) = max(0, S(t−1) + (μ − x(t))/σ − k)
Was messen wir? Der CUSUM-Test überwacht die Trade-Sequenz fortlaufend und summiert Abweichungen unter den Erwartungswert auf. Er erkennt nicht nur OB die Performance nachlässt, sondern ab WANN.
Warum ist das wichtig? Der Alterungs-Test (Hälfte 1 vs. Hälfte 2) ist grob: Ein Edge, der erst in den letzten 20% der Historie stirbt, kann darin untergehen. CUSUM schlägt an dem Punkt Alarm, an dem der strukturelle Bruch beginnt.
Interpretation: Angezeigt wird das Verhältnis der CUSUM-Statistik zur Alarmschwelle (die Schwelle ist auf die Länge Ihrer Historie kalibriert, ~5% Fehlalarmrate). Grün (Ratio < 1): Keine anhaltende Verschlechterung erkennbar. Rot (Ratio ≥ 1): Ab einem bestimmten Trade liegt die Performance systematisch unter dem historischen Schnitt – prüfe, was sich ab diesem Zeitpunkt am Markt oder am Setup geändert hat.
1. Gesamt-Historie
2,1900
Diagnose: Struktureller Bruch erkannt ab Trade #22 (07.11.2023). Aber: Die Schwächephase ist nachweislich überwunden. Seit Trade #65 (15.04.2024) wieder Ø 38,63 $/Trade bei 69,7% Winrate über 534 Trades (Vor-Bruch-Niveau: -25,84 $/Trade). Der Alarm dokumentiert eine historische Delle – beim nächsten Report prüfen, ob die Erholung anhält.
Der Cluster-Test (Wald-Wolfowitz Runs)
Z = (R - μR) / σR
Was messen wir? Wir zählen die "Serien" (Runs) von Gewinnen und Verlusten und prüfen, ob sie häufiger hintereinander auftreten, als es der reine Zufall zulassen würde.
Warum ist das wichtig? Wenn Verluste "geklumpt" auftreten (Verlust-Cluster), zerstört das Ihr Konto viel schneller als isolierte Verluste. Es deutet oft auf eine Anfälligkeit in ganz bestimmten (zusammenhängenden) Marktphasen hin.
Interpretation: Grün: Die Abfolge Ihrer Trades ist gesund und zufällig verteilt. Rot: Ihr System ist anfällig für Cluster-Risiken. Nach einem Verlust steigt die statistische Gefahr, dass direkt der nächste folgt.
1. Gesamt-Historie
0,0017
Diagnose: Achtung Cluster-Risiko: Verluste neigen dazu, in Serien aufzutreten und können Ihr Konto in wenigen Blöcken stark schädigen.
Der P-Hacking Test (Permutation)
p = Anteil der Permutationen mit Max-DD ≤ historischem Max-DD
Was messen wir? Wir mischen die Reihenfolge Ihrer Trades 1.000 Mal zufällig durch und messen jedes Mal den maximalen Drawdown. Dann fragen wir: Wie ungewöhnlich klein war Ihr historischer Drawdown im Vergleich dazu?
Warum ist das wichtig? Derselbe Satz Trades kann je nach Reihenfolge einen harmlosen oder einen brutalen Drawdown erzeugen (Sequence-of-Returns-Risiko). Wenn Ihre historische Reihenfolge außergewöhnlich gnädig war, unterschätzt der Backtest Ihr echtes Risiko.
Interpretation: Grün (p > 0,05): Ihr historischer Drawdown liegt im normalen Bereich zufälliger Reihenfolgen – der Backtest wurde nicht durch eine Glücks-Sequenz geschönt. Rot (p ≤ 0,05): Ihr Drawdown war verdächtig klein; in fast allen anderen Reihenfolgen wäre er tiefer ausgefallen. Plane live mit den Monte-Carlo-Grenzen (Notbremsen-Block), nicht mit dem Backtest-Drawdown.
1. Gesamt-Historie
0,9990
Diagnose: Der historische Drawdown liegt im normalen Bereich zufälliger Trade-Reihenfolgen – der Backtest profitiert nicht von einer Glücks-Sequenz.
Walk-Forward & HandelsempfehlungHält die Strategie in ungesehenen Daten?WFE 97%
Kurz gesagt: Dieser Test prüft, ob die Strategie auch auf Daten funktioniert, die sie beim Optimieren nie gesehen hat. Ergebnis: rund 97 % der Labor-Leistung blieben dabei erhalten.

7. Walk-Forward Efficiency (AI Optimized)

Institutionelle Nested Walk-Forward Optimization (mit 2D-Plateau-Scoring)
Dieser Stresstest nutzt kein statisches Curve-Fitting, sondern eine verschachtelte ("nested") Optimierung. Die KI wandert durch die Historie, isoliert das In-Sample-Fenster und baut eine Matrix aus bis zu 225 Parameter-Kombinationen (Winrate, MAE, Golden Limit & Stop-Overlay aus den MAE-Perzentilen der Gewinner). Anstatt blinde Ausreißer zu wählen, sucht sie das stabilste Plateau, verwirft zu schmale Zeitfenster-Sets (unter ~10% der Trades) und friert diese Parameter ein. Die Zeitfenster werden im Walk-Forward auf Stundenbasis geprüft – das ist robuster bei kurzen Fenstern. Erst danach erfolgt der ungesehene Out-of-Sample-Test (Blind-Test). Angezeigt wird der Median über alle getesteten IS/OOS-Fensterkombinationen – nicht das beste Fenster, denn das wäre Selektions-Bias.

Aussagekraft dieser Walk-Forward-Analyse: EINGESCHRÄNKT

Der WFE-Wert ist nur eingeschränkt belastbar:

  • Nur ~3.8 Trades pro Woche. Bei dieser Frequenz enthalten die Stunden-Zellen der rollierenden Fenster zu wenige Trades fuer belastbare Aussagen.

Was für diese Strategie stattdessen zählt: Die Stresstests oben bewerten die Strategie selbst – sie bleiben voll gültig und sind hier das maßgebliche Urteil. Für einen echten Robustheits-Beweis nutze die Walk-Forward-Optimierung in NinjaTrader (Strategie-Parameter je Fenster neu optimieren) und lade das Out-of-Sample-Ergebnis mit gesetzter WFO-Checkbox hoch – das prüft die Strategie dort, wo ihre Stellschrauben wirklich liegen, statt an der Uhrzeit.

WFE Score
97,4%
Exzellente Robustheit! Der Filter funktioniert in unbekannten Daten extrem konstant.
IS Profit (p.a.)
$7.308,27
Annualisierte Labor-Performance der optimierten Zeitfenster.
OOS Profit (p.a.)
$7.114,66
Blind erzielte Realdaten-Performance (Live-Simulation).

Robuste Auswahl: Gezeigt wird der Median aus 12 getesteten IS/OOS-Fensterkombinationen (WFE-Spanne: 76,9% bis 111,6%). Das beste Fenster wird bewusst nicht herausgepickt, da dies die Robustheit systematisch überschätzen würde.

Aktuelle Handelsempfehlung (jüngstes Fenster: 01.03.26 – 28.08.26, 180 Tage)

Einzustellende Parameter: Bann ab: 9 Trades, Schwere: 0.50, Stop: ohne
Stop-Loss: keiner – Original-Exits beibehalten

Gültig bis: 12.10.26 (gerechnet ab dem letzten Trade Ihrer CSV) – spätestens dann neue CSV hochladen und die dann aktuelle Empfehlung übernehmen. Der 45-Tage-Rhythmus ist exakt der Re-Optimierungs-Takt, den der Walk-Forward-Test oben validiert hat. Liegt das Datum bereits in der Vergangenheit, ist Ihre CSV zu alt – direkt neu exportieren und hochladen.

Beste Zeitfenster pro Tag:3zusammenhängende Fenster je Wochentag
TagFensterTradesØ/TradeWinrateØ-MAE (Risiko)PnL

Exakte Optimierung: die profitabelsten bis zu X nicht überlappenden, zusammenhängenden Stunden-Blöcke je Tag (Basis: jüngstes Fenster inkl. gewähltem Stop). Tage ohne positives Fenster erscheinen nicht – dort lieber pausieren. Im 30-Minuten-Raster sind einzelne Zellen dünn besetzt: nutze es zur Feinjustierung der Grenzen, die Entscheidung triff im 60er-Raster und mit Blick auf die Trades-Spalte.

Basis sind nur die letzten 180 Tage – die Kennzahlen pro Fenster sind entsprechend grob. Validiert ist das Verfahren (Median-WFE oben), nicht dieses konkrete Fenster-Set.

Detailliertes Protokoll der 20 Rollierungs-Schritte
SchrittIn-Sample Fenster (180 Tage lernen) & Gefundene ZeitfensterKI-OptimumIS ProfitOut-Of-Sample Fenster (45 Tage blind)OOS Profit
#1
01.09.23 – 27.02.24
Ausschlüsse: Mon: 15:00-16:00 | Tue: 15:00-16:00 | Wed: 15:00-16:00
Bann ab: 3 Trades, Schwere: 0.25, Stop: 170$+542,8001.03.24 – 12.04.24-337,00
#2
16.10.23 – 12.04.24
Ausschlüsse: Mon: 15:00-16:00 | Tue: 15:00-16:00 | Fri: 14:00-15:00
Bann ab: 3 Trades, Schwere: 0.25, Stop: ohne+371,6015.04.24 – 27.05.24-537,40
#3
30.11.23 – 27.05.24
Ausschlüsse: Mon: 15:00-16:00 | Tue: 15:00-17:00 | Fri: 14:00-15:00, 16:00-17:00
Bann ab: 3 Trades, Schwere: 0.00, Stop: ohne+455,2030.05.24 – 11.07.24+528,20
#4
14.01.24 – 11.07.24
Ausschlüsse: keine (alle Zeitfenster aktiv)
Bann ab: 6 Trades, Schwere: 0.50, Stop: ohne+1.025,4014.07.24 – 25.08.24+2.017,20
#5
28.02.24 – 25.08.24
Ausschlüsse: keine (alle Zeitfenster aktiv)
Bann ab: 6 Trades, Schwere: 0.50, Stop: ohne+3.015,6028.08.24 – 09.10.24+1.246,80
#6
13.04.24 – 09.10.24
Ausschlüsse: keine (alle Zeitfenster aktiv)
Bann ab: 9 Trades, Schwere: 0.25, Stop: ohne+4.557,4012.10.24 – 23.11.24+636,80
#7
28.05.24 – 23.11.24
Ausschlüsse: keine (alle Zeitfenster aktiv)
Bann ab: 6 Trades, Schwere: 0.25, Stop: ohne+5.159,0026.11.24 – 07.01.25+1.039,00
#8
12.07.24 – 07.01.25
Ausschlüsse: keine (alle Zeitfenster aktiv)
Bann ab: 6 Trades, Schwere: 0.25, Stop: ohne+4.656,2010.01.25 – 21.02.25+548,60
#9
26.08.24 – 21.02.25
Ausschlüsse: Mon: 15:00-16:00 | Wed: 15:00-16:00
Bann ab: 3 Trades, Schwere: 0.00, Stop: 183$+3.250,0024.02.25 – 07.04.25+658,80
#10
10.10.24 – 07.04.25
Ausschlüsse: keine (alle Zeitfenster aktiv)
Bann ab: 9 Trades, Schwere: 0.50, Stop: ohne+2.246,6010.04.25 – 22.05.25+2.309,20
#11
24.11.24 – 22.05.25
Ausschlüsse: keine (alle Zeitfenster aktiv)
Bann ab: 6 Trades, Schwere: 0.50, Stop: ohne+4.447,6025.05.25 – 06.07.25+2.072,40
#12
08.01.25 – 06.07.25
Ausschlüsse: keine (alle Zeitfenster aktiv)
Bann ab: 6 Trades, Schwere: 0.25, Stop: ohne+5.982,2009.07.25 – 20.08.25+888,40
#13
22.02.25 – 20.08.25
Ausschlüsse: keine (alle Zeitfenster aktiv)
Bann ab: 6 Trades, Schwere: 0.25, Stop: ohne+6.322,0023.08.25 – 04.10.25+800,20
#14
08.04.25 – 04.10.25
Ausschlüsse: keine (alle Zeitfenster aktiv)
Bann ab: 6 Trades, Schwere: 0.25, Stop: ohne+6.707,6007.10.25 – 18.11.25+1.265,00
#15
23.05.25 – 18.11.25
Ausschlüsse: keine (alle Zeitfenster aktiv)
Bann ab: 6 Trades, Schwere: 0.50, Stop: ohne+4.929,6021.11.25 – 02.01.26+708,80
#16
07.07.25 – 02.01.26
Ausschlüsse: keine (alle Zeitfenster aktiv)
Bann ab: 9 Trades, Schwere: 0.50, Stop: ohne+3.913,6005.01.26 – 16.02.26+739,80
#17
21.08.25 – 16.02.26
Ausschlüsse: keine (alle Zeitfenster aktiv)
Bann ab: 6 Trades, Schwere: 0.50, Stop: ohne+3.765,0019.02.26 – 02.04.26+79,20
#18
05.10.25 – 02.04.26
Ausschlüsse: keine (alle Zeitfenster aktiv)
Bann ab: 9 Trades, Schwere: 0.50, Stop: ohne+3.152,8005.04.26 – 17.05.26+997,80
#19
19.11.25 – 17.05.26
Ausschlüsse: Mon: 09:00-10:00 | Wed: 15:00-16:00
Bann ab: 9 Trades, Schwere: 0.00, Stop: ohne+3.991,4020.05.26 – 01.07.26-166,20
#20
03.01.26 – 01.07.26
Ausschlüsse: Tue: 15:00-16:00, 18:00-19:00, 20:00-21:00 | Wed: 15:00-16:00 | Thu: 19:00-20:00
Bann ab: 3 Trades, Schwere: 0.00, Stop: 223$+3.590,0004.07.26 – 15.08.26+1.267,70
KI-Gutachten & RisikoAlles in Worten — und wie viel Risiko?Urteil: grün
Kurz gesagt: Das Wichtigste steht schon oben im Cockpit unter „In Klartext". Hier lesen Sie die ausführliche Einordnung Abschnitt für Abschnitt – und ganz konkret, wie viel Risiko pro Trade sinnvoll ist.

8. KI-Diagnose & Dynamisches Risikomanagement

Die Kurzfassung steht oben im Cockpit unter „In Klartext". Hier die ausführliche Einordnung – klicken Sie einen Abschnitt an, um ihn zu öffnen:

Datenbasis & Belastbarkeit der Auswertung

Drei Jahre Historie mit 598 Trades, aber als Standard-Backtest in-sample erzeugt — die Zahlen sind zu optimistisch zu lesen.

Der Auswertungszeitraum reicht vom 01.09.2023 bis zum 28.08.2026 und umfasst 598 Trades mit 18.530,20 $ Nettogewinn. DATEN_HERKUNFT weist ausdrücklich einen Standard-Backtest mit einer festen Parametrisierung aus, also keine Walk-Forward-OOS-Basis; entsprechend gilt für alle Stresstests die übliche In-Sample-Skepsis.

Erschwerend kommt hinzu, dass die ACTION_ZONES_DATEN mit 586 Trades und 18.566,40 $ Profit aus 150 getesteten Zellen selektiert wurden. Dass die Deflated Sharpe Ratio dort mit n_trials = 150 immer noch 0,9941 erreicht, ist das eigentlich wertvolle Detail — der Selektionsvorteil wurde also mitgerechnet.

Der einzige echte Out-of-Sample-Beleg liegt im WFE_PROFIL: 20 Schritte, 0 leere Schritte, OOS-Summe 16.763,30 $, WFE-Median 97,35 % bei einer Spanne von 76,89 % bis 111,63 %. Die Aussagekraft ist laut Report jedoch als eingeschränkt markiert, weil nur rund 3,8 Trades pro Woche anfallen.

Die Unabhängigkeitsprüfung fällt durch: Design-Effekt 1,543, ICC 0,543, im Schnitt 2,0 Trades pro Signal. Die effektive Stichprobe beträgt 388 Trades, alle p-Werte sind um den Faktor 1,242 zu optimistisch — bei p = 0,0 für den t-Test bleibt die Kante trotzdem stehen.

Ertragsprofil

Hohe Trefferquote mit ungünstiger Payoff-Ratio — viele kleine Gewinne tragen größere Einzelverluste.

Bei 68,23 % Trefferquote (408 Gewinner, 190 Verlierer) steht ein durchschnittlicher Gewinn von 97,69 $ gegen einen durchschnittlichen Verlust von 112,24 $, Ratio 0,87. Der Profit Factor liegt bei 1,87, der Ø-Trade bei 30,99 $ mit einem 95-%-Intervall von 20,13 $ bis 41,07 $.

Das Drawdown-Profil ist unauffällig: 2.943,60 $ realisierter Max-Drawdown gegen die Monte-Carlo-99-%-Grenze von 3.474 $, Block-Bootstrap-Intervall des Drawdowns 1.004,40 $ bis 3.823,69 $. Der größte Verlust von -258,60 $ entspricht nur 2,3 Ø-Verlusten, das Tail-Risiko ist damit gezähmt.

Die Profitkonzentration ist gering: Die Top-5-Trades tragen nur 7,9 % des Gewinns, und ohne die besten 5 % der Trades bleiben 12.373,20 $ Nettoprofit von 18.530,20 $ übrig (Anteil Top-5 % = 33,2 %). Das System lebt von Breite, nicht von Einzeltreffern.

Psychologisch verlangt dieses Profil Toleranz für einzelne große Verlusttage: bis zu 5 Verlierer in Folge, 19 Gewinner in Folge, 74,4 % positive Wochen bei 129 Wochen und maximal 3 Verlustwochen hintereinander.

Statistische Belastbarkeit (der Referenz-Check erklärt)

Acht von neun Laborwerten grün, ein roter Wert beim Verlust-Cluster-Test und ein gelber CUSUM-Wert.

Edge-Signifikanz t = 5,97 gegen Referenz ≥ 2,0 (Action Zones 6,07) — deutlich im grünen Bereich, allerdings um Faktor 1,242 nach unten zu korrigieren; auch dann bleibt t über 4,8, was der Signal-t-Wert von 4,803 bestätigt. Die Deflated Sharpe Ratio erreicht 1,0 bzw. 0,9941 bei Referenz ≥ 0,95, die BCa-Untergrenze des Ø-Trades liegt mit 20,13 $ klar über 0 und der Profit ohne Top-5 %-Trades bei 12.373,20 $ gegen Referenz > 0.

Der Alterungstest (Mann-Whitney) zeigt p = 0,2298 gegen Referenz > 0,05, in den Action Zones p = 0,1826 — kein Nachweis, dass die jüngere Hälfte schwächer ist. Reihenfolge-Glück ist mit Permutations-p = 0,999 ausgeschlossen, der kleine Drawdown war also nicht Zufall der Trade-Sequenz.

Der rote Wert: Runs-Test p = 0,0017 (Action Zones 0,0043) gegen Referenz > 0,05. Verluste treten in Serien auf statt zufällig verteilt — konkret heißt das für diese Strategie, dass die realistische Verlustserie schlechter ist als die Binomialrechnung suggeriert und dass ein reiner Trade-Zähler als Kill-Switch zu spät auslöst. Auch nach Mehrfachtest-Korrektur bleibt der Cluster-Befund signifikant (p_korrigiert = 0,0025).

CUSUM-Drift-Ratio 2,19 gegen Referenz < 1,0 steht gelb, mit dem Vermerk Bruch nachweislich überwunden. Die Walk-Forward Efficiency von 97,35 % gegen Referenz ≥ 50 % ist grün, aber mit dem Zusatz eingeschränkte Aussagekraft. Die Sharpe-Zufallsschwelle wird knapp überboten: 2,778 gemessen gegen 2,564 erwartetes Optimierungsglück bei 110 Varianten — Faktor 0,9, also wenig Sicherheitsmarge.

Zeitliche Stabilität

Der CUSUM-Bruch von 2023 ist nachweislich erholt; das System baut aktuell nicht ab.

Der CUSUM-Alarm setzte bei Trade #22 am 07.11.2023 ein, Ratio 2,19 gegen Schwelle 7,53 bei max_stat 16,53. Der Status lautet erholt: Erholung seit Trade #65 am 15.04.2024. Vor dem Bruch lagen 21 Trades mit -25,84 $ Ø und 57,1 % Trefferquote, seither 534 Trades mit 38,63 $ Ø und 69,7 % Trefferquote.

Diese Zahlen sind eindeutig: Es handelt sich um eine historische Anlaufdelle in den ersten Wochen, nicht um einen laufenden Drift. Der Mann-Whitney-Wert von p = 0,2298 ist folgerichtig unauffällig; selbst wenn er anschlagen würde, wäre er hier vermutlich nur ein Echo derselben Delle.

Die Fenster-Konsistenz stützt das: 86 von 110 Zeitfenstern positiv, Vorzeichentest p = 0,0, und ohne das beste Fenster (1.163,80 $) bleiben 17.366,40 $ von 18.530,20 $ — das Ergebnis hängt nicht an einer Periode. Die Wochenstatistik zeigt 74,4 % positive Wochen bei maximal 3 Verlustwochen in Folge.

Die Parameterstabilität ist die schwächere Seite: Nur 5 von 20 WFO-Schritten wählten identische Parameter (Bann ab 6 Trades, Schwere 0,25, Stop ohne), und die OOS-Schritte 1, 2 und 19 waren negativ (-337,00 $, -537,40 $, -166,20 $). Für die kommenden Wochen heißt das: mit einzelnen negativen 45-Tage-Fenstern rechnen, ohne daraus sofort einen Abbau abzuleiten.

Marktumfeld & Regime

Der Edge ist nur im Bullenmarkt breit belegt; Bär × Ruhig ist mit 0 Trades völlig ungetestet.

Drei Zellen sind belastbar: Bulle × Ruhig mit 206 Trades und 21,92 $ Expectancy, Bulle × Normal mit 224 Trades und 29,27 $, Bulle × Stress mit 108 Trades und 37,64 $. Zusammen decken sie 538 der 598 Trades ab — das System ist zuerst eine Wette auf ein fortbestehendes Bullen-Umfeld, gestützt durch 691 Bullen- gegen nur 58 Bär-Tage im Zeitraum.

Auf der Bärenseite sind die Belege dünn: Bär × Normal mit 18 Trades und 18,96 $ Expectancy ist ausdrücklich als nicht bewertbar markiert, Bär × Stress zeigt mit 42 Trades und 72,64 $ Expectancy die besten Werte, ist aber ebenfalls klein. Bär × Ruhig ist mit 0 Trades ungetestet — das ist ein eigenständiges Risiko, kein Freibrief.

Die Regime-Konzentration liegt bei 35,4 % des Profits in Bulle × Normal. Das ist moderat, aber in Verbindung mit der Trendverteilung bleibt das Kernrisiko ein längerer, ruhiger Abwärtsmarkt, für den keine einzige Beobachtung existiert.

Zeitlich ist der Ertrag stark auf Freitag konzentriert: Friday 16:00 bringt 3.346,20 $ bei 68 Trades und 69,1 % Trefferquote, Friday 17:00 1.675,60 $ bei nur 14 Trades und 100 % Trefferquote — letzteres ist eine zu kleine Stichprobe für eine Planungsgrundlage. Schwach sind Wednesday 15:00 mit -36,20 $ bei 12 Trades und Tuesday 15:30 mit 17,80 $ bei 72 Trades und nur 58,3 % Trefferquote; im Empfehlungsfenster ist der Mittwoch mit -16,49 $ Expectancy bei 28 Trades sogar negativ.

Risiko & Positionsgröße

Kelly von 31,72 Prozent ist nicht handelbar; maximal 2 Prozent Risiko pro Trade, abgesichert durch Cluster-taugliche Kill-Switches.

Die kelly_fraction von 31,72 % (Action Zones 32,39 %) ist eine rechnerische Größe, keine Empfehlung. Bei einer Trefferquote von 68,23 % reagiert die Kelly-Formel extrem empfindlich auf Schätzfehler der Winrate: Das Bootstrap-Intervall der Trefferquote reicht von 73,58 % bis 82,61 %, und schon wenige Prozentpunkte weniger senken die optimale Größe drastisch. Verbindliche Obergrenze: 2 % Risiko pro Trade, angesichts des Cluster-Befunds eher 1 %.

Die Kill-Switch-Marken leiten sich aus der Historie ab: Der Max-Drawdown von 2.943,60 $ liegt unter der MC-99-%-Grenze von 3.474 $, das Bootstrap-Intervall reicht aber bis 3.823,69 $. Praktisch: Bei 3.500 $ Drawdown Positionsgröße halbieren, bei 3.900 $ Handel stoppen und neu auditieren.

Wegen p = 0,0017 im Runs-Test darf der Serien-Stopp nicht über Einzeltrades laufen. Historisch traten maximal 5 Verlierer in Folge und maximal 3 Verlustwochen hintereinander auf; ein vierte Verlustwoche in Folge oder 6 Verlierer in Serie ist damit ein statistisch neues Ereignis und Anlass zur Halbierung.

Erwartungsseitig bleibt der Puffer solide: Block-Bootstrap-CI des Ø-Trades 35,24 $ bis 88,04 $ bei Blocklänge 7, Profit-Factor-CI 1,413 bis 2,659, schließt 1 nicht ein. Rechnen Sie mit 25,6 % Verlustwochen-Anteil (100 minus 74,4 %) als Normalzustand.

Handlungsplan & Watchlist

Ohne festen Stop weiterlaufen lassen, Fokus auf Freitag, Mittwoch-Slot streichen und Risiko hart deckeln.

1. Keinen engen Stop einführen. Die Stop-Simulation zeigt: Stop bei 99,00 $ (p75 der Gewinner-MAE) stoppt 25,2 % der Gewinner aus und kostet -9.128,80 $, also Rückgang von 18.530,20 $ auf 9.401,40 $. Stop bei 166,30 $ (p90) kostet -4.923,70 $, Stop bei 205,60 $ (p95) noch -2.580,00 $ bei 5,1 % ausgestoppten Gewinnern. Falls ein Katastrophen-Stop aus Broker- oder Margin-Gründen zwingend ist, dann bei 205,60 $ als kleinstes Übel — Caveat: Diese Simulation ist In-Sample, ohne Slippage und ohne Intrabar-Reihenfolge und muss vor Live-Einsatz out-of-sample geprüft werden.

2. Kein Take-Profit-Eingriff. Nur 4,7 % der Verlierer hatten einen Buchgewinn über dem Ø-Gewinn von 97,69 $; der MFE-Median der Verlierer liegt bei 46,00 $, p75 bei 62,00 $. Ein TP in diesem Bereich würde vor allem Gewinner beschneiden.

3. Zeitfenster gemäß Empfehlung fahren (Blacklist, Bann ab 9 Trades, Schwere 0,50, ohne Stop, gültig bis 12.10.2026) und zusätzlich den Mittwochs-Block prüfen: 28 Trades mit -461,80 $ und -16,49 $ Expectancy. Freitag trägt mit 36 Trades und 2.298,40 $ bei 63,84 $ Expectancy den Kern.

4. Risiko auf maximal 2 % pro Trade, praktisch 1 %, mit Halbierung bei 3.500 $ Drawdown und Stopp bei 3.900 $. Neu-Optimierung im 45-Tage-Rhythmus.

Watchlist für den nächsten Report: erstens der Runs-Test-p-Wert (aktuell 0,0017) — bleibt er unter 0,05, ist die Clusterung strukturell und der Tagesverlust-Deckel dauerhaft nötig; zweitens der CUSUM-bruch_status (aktuell erholt seit 15.04.2024), ein Wechsel auf aktiv erfordert sofortige Risikoreduktion; drittens die Regime-Zelle Bär × Ruhig (aktuell 0 Trades) samt Trendverteilung 691 zu 58 Tage, denn erst dort zeigt sich, ob der Edge außerhalb des Bullenmarkts existiert.

Empfohlenes Risiko (Quarter-Kelly)

Ungefiltertes System
5,00%
pro Trade
Formelwert gekappt: Rechnerisch ergäbe Quarter-Kelly hier 7,93% pro Trade. Bei Systemen mit sehr hoher Trefferquote ist die Kelly-Formel extrem empfindlich gegen Schätzfehler: Sinkt die echte Trefferquote nur um wenige Prozentpunkte, kollabiert der Wert – und eine kurze Verlustserie würde bei solchen Einsätzen das Konto verwüsten. Angezeigt wird deshalb eine harte Obergrenze von 5%. Professioneller Rahmen in der Praxis: 1–2% pro Trade.
Was bedeuten diese Zahlen? Das Quarter-Kelly-Kriterium ist eine mathematische Formel aus dem professionellen Risikomanagement. Sie berechnet auf Basis Ihrer Trefferquote und Ihres Chance-Risiko-Verhältnisses genau den Prozentsatz Ihres Gesamtkapitals, den Sie pro Trade riskieren sollten (Stop-Loss). Die Viertel-Gewichtung ("Quarter") schützt Ihr Konto dabei massiv vor tiefen Drawdowns.

9. Live-Trading Notbremsen (99% CI)

CI steht für Confidence Interval (Konfidenzintervall). Die hier verwendeten 99% CI-Grenzen basieren auf 1.000 Block-Bootstrap-Simulationen Ihrer Strategie – dabei bleiben die typischen Verlust-Serien Ihres Systems erhalten, statt sie durch zufälliges Mischen zu verharmlosen. Sie definieren den Bereich, in dem sich Drawdowns und Verlustserien mit einer Wahrscheinlichkeit von etwa 99% bewegen sollten, sofern Sie mit derselben Logik, demselben Risiko pro Trade und vergleichbaren Marktbedingungen arbeiten.

Ihr System

Max. Drawdown

$3.474,15

Worst-Case: Erreicht Ihr Drawdown diese Grenze, ist sofortige Handelsunterbrechung angesagt.

Max. Pechsträhne

8 Trades

Worst-Case: Überschreitet das System diese Verlustserie, veraltet es vermutlich gerade am Markt.

P(Verlustphase)

3,2%

Einordnung: So wahrscheinlich endet ein beliebiger Abschnitt von 100 Trades netto im Minus – auch wenn das System völlig intakt ist. Eine Verlustphase dieser Größenordnung ist also kein Abschaltgrund, sondern fest einzuplanen. Abgeschaltet wird erst an den beiden Grenzen darüber.

Empfehlung eines Risikomanagers: Notieren Sie sich die beiden Kill-Switch-Grenzen (maximaler Drawdown und maximale Pechsträhne aus dem Kapitel „KI-Gutachten & Risiko") schriftlich und lege sie vor dem ersten Live-Einsatz als feste Abbruchregeln fest – am besten sichtbar am Monitor. Wird eine Grenze erreicht, stoppe Bot oder manuelles Trading sofort (Regime Shift). Diese Limits im laufenden Drawdown „nach unten anzupassen“ ist ein klassisches Muster des Selbstbetrugs; ein Abschalten an den 99%-CI-Grenzen ist kein Eingeständnis des Scheiterns, sondern professionelles Risikomanagement.
Hinweis zur Statistik-Engine 9.19: Dieser Report nutzt die überarbeitete, strengere Methodik: einseitiger Alterungstest, Median-Walk-Forward mit Embargo, Bayes-adjustierte Zell-Winrates, Block-Bootstrap, Deflated Sharpe Ratio und Markt-Regime-Analyse. Die Werte sind dadurch nicht direkt vergleichbar mit Reports älterer Versionen. Niedrigere Scores bedeuten keine Verschlechterung Ihrer Strategie, sondern eine ehrlichere Messung – insbesondere fallen p-Werte des Alterungstests bei echter Degradation jetzt etwa halb so hoch aus, bei einer Verbesserung dagegen deutlich höher.
Risk Disclaimer & rechtliche Hinweise

Risk Disclaimer. Das Produkt stellt keine Finanzberatung, Anleitung oder Empfehlung dar, irgendwelche Trades, Investitionen oder Entscheidungen zu treffen oder zu unterlassen. Der bereitgestellte Inhalt ist unpersönlich und nicht auf einen bestimmten Kunden, Händler oder Geschäftskontext zugeschnitten. Es wird dringend empfohlen, vor jeglichen Entscheidungen eine professionelle Finanzberatung einzuholen. Ergebnisse sind nicht garantiert und können individuell variieren. Der Handel beinhaltet erhebliche Risiken, einschließlich des möglichen vollständigen Verlustes Ihrer Investition. Vergangene Marktperformance ist kein verlässlicher Indikator für zukünftige Ergebnisse. Jede Investition erfolgt auf eigenes Risiko, und die volle Verantwortung liegt ausschließlich bei Ihnen.

Automatisierte Handelsstrategien. Unsere automatisierten Handelsstrategien für die NinjaTrader-Handelssoftware dienen ausschließlich Bildungszwecken, dem manuellen Vergleich offener Handelspositionen mit einer Strategie und professionellem Backtesting. Wir empfehlen, diese Strategien in einem Demokonto zu testen, bevor echtes Kapital eingesetzt wird. Die Entscheidung, eine Order zu platzieren, und die Kriterien für deren Eröffnung liegen vollständig in der Verantwortung des Traders. Wir schließen jede Haftung für fehlerhafte oder unerwünschte Positionierungen aus. Da wir Ihre persönliche Hardware- und Softwareumgebung sowie die Qualität zukünftiger Updates von Brokern oder Kurslieferanten nicht beeinflussen können, übernehmen wir keine Haftung für die Funktionalität oder Richtigkeit der angebotenen Handelsstrategien. Prüfen Sie alle vorgeschlagenen Transaktionen sorgfältig selbst.

Risikohinweis. Der Handel mit Futures und Kryptowährungen birgt erhebliche Risiken und ist nicht für jeden Anleger geeignet. Es besteht die Möglichkeit, die gesamte ursprüngliche Investition oder mehr zu verlieren. Nur Risikokapital sollte für den Handel eingesetzt werden – also Kapital, dessen Verlust keine Beeinträchtigung der finanziellen Sicherheit oder des Lebensstils verursacht. Nur Anleger mit ausreichend Risikokapital sollten den Handel in Betracht ziehen. Die Wertentwicklung in der Vergangenheit ist kein verlässlicher Hinweis auf zukünftige Ergebnisse.

Hypothetical Performance Disclosure (CFTC Rule 4.41 / NFA). Hypothetical performance results have many inherent limitations, some of which are described below. No representation is being made that any account will or is likely to achieve profits or losses similar to those shown; in fact, there are frequently sharp differences between hypothetical performance results and the actual results subsequently achieved by any particular trading program. One of the limitations of hypothetical performance results is that they are generally prepared with the benefit of hindsight. In addition, hypothetical trading does not involve financial risk, and no hypothetical trading record can completely account for the impact of financial risk of actual trading. For example, the ability to withstand losses or to adhere to a particular trading program in spite of trading losses are material points which can also adversely affect actual trading results. There are numerous other factors related to the markets in general or to the implementation of any specific trading program which cannot be fully accounted for in the preparation of hypothetical performance results and all of which can adversely affect actual trading results.

Deutsche Übersetzung (unverbindlich): Hypothetische Performance-Ergebnisse unterliegen zahlreichen systembedingten Einschränkungen. Es wird nicht zugesichert, dass ein Konto Gewinne oder Verluste erzielt, die den dargestellten ähneln; tatsächliche und hypothetische Ergebnisse weichen häufig deutlich voneinander ab. Hypothetische Ergebnisse werden im Nachhinein erstellt, sind nicht mit finanziellem Risiko verbunden und können dessen Auswirkungen im realen Handel nicht vollständig abbilden – etwa die Fähigkeit, Verluste zu verkraften oder trotz Verlusten an einer Strategie festzuhalten. Zahlreiche weitere Markt- und Umsetzungsfaktoren können reale Ergebnisse nachteilig beeinflussen und sind in hypothetischen Berechnungen nicht vollständig berücksichtigt.