Blog
Statistische Ausreißer im Basketball identifizieren
Warum Ausreißer wichtig sind
Ein einzelner Monster-3‑Punkte-Wurf kann die Statistik einer ganzen Saison verzerren. Und das ist kein Kavaliersdelikt – das ist Geld, das Sie verloren oder gewonnen haben könnten. Wenn Sie nicht wissen, welche Werte das Spielfeld sprengen, setzen Sie blind.
Methoden im Überblick
Es gibt ein Arsenal von Techniken. Verwechseln Sie nicht das alte Messer mit dem Laser. Jeder Ansatz hat seine eigenen Vor- und Nachteile, und Sie müssen das passende Werkzeug wählen, bevor Sie sich in die Daten stürzen.
Z‑Score
Der Klassiker. Subtrahiere den Mittelwert und teile durch die Standardabweichung. Wenn das Ergebnis > 3 oder < -3 ist, haben Sie einen Kandidaten. Schnelle Aussage, aber empfindlich gegenüber schrägen Verteilungen. Das bedeutet: Ein Spieler, der regelmäßig über 30 Punkte erzielt, kann jedes Mal als Ausreißer gelten, obwohl das sein Normalbereich ist.
IQR (Interquartilsabstand)
Hier geht’s um die Mitte des Datensatzes. Box‑Plot‑Fans kennen das: Untere Grenze = Q1 - 1,5·IQR, obere Grenze = Q3 + 1,5·IQR. Alles außerhalb wird rot markiert. Robust gegenüber Extremwerten, aber bei stark verzerrten Daten kann das Feld zu eng werden.
MAD & robustere Varianten
Median‑Abweichung statt Mittelwert. Die Formel ist simpel, die Wirkung enorm: Median + k·MAD. Wählen Sie k = 3 für konservative Ausreißerkennung. Diese Methode ignoriert die „schwere“ Verteilung und fokussiert sich auf das Kernstück. Perfekt, wenn Sie plötzlich ein Spiel mit überragender Pace analysieren.
Praxis: Daten sauber machen
Bevor Sie irgendwelche Statistiken würfeln, entfernen Sie fehlende Werte, korrigieren Sie falsche Spielzeiten und normalisieren Sie die Minuten pro Spiel. Ein kurzer Filter: Nur Spiele mit ≥ 20 Minuten Spielzeit. Ohne diese Grundreinigung tanzen Ihre Outlier‑Algorithmen mit Fehldaten im Kreis.
Werkzeuge und Quick‑Check
Python‑Pandas, R‑dplyr, oder sogar Excel‑Power‑Query. Machen Sie sich nicht verrückt, das ist kein Hexenwerk. Ein Einzeiler wie df['z'] = (df['pts']-df['pts'].mean())/df['pts'].std() reicht oft. Und wenn Sie nach schnellen Beispielen suchen, werfen Sie einen Blick auf sportwettenbasketball.com. Dort finden Sie fertige Skripte und Daten‑Feeds, die Sie sofort einsetzen können.
Handeln Sie jetzt
Exportieren Sie die letzten 30 Spiele Ihrer Favoriten, berechnen Sie den Z‑Score, filtern Sie nach |Z| > 2,5 und prüfen Sie die Kontext‑Faktoren: Verletzungen, Reisestrappe, Pace. Wenn ein Wert immer wieder aus der Reihe tanzt, markieren Sie ihn als Kern‑Ausreißer und passen Sie Ihre Wetten entsprechend an.