Statistik unterstützt die Analyse und Modellierung, indem sie Daten strukturiert beschreibt und prüft. Mit SQL, Power Query und Python werden Daten gesammelt, bereinigt und aufbereitet. Statistische Kennzahlen wie Verteilungen, Lage- und Streuungsmaße sowie Korrelationen helfen, relevante Muster zu erkennen. Diese Grundlagen dienen als Ausgangspunkt für Data-Science-Modelle und analytische Fragestellungen. Ziel ist eine belastbare Grundlage für Entscheidungen und Modellprozesse.

Datenbasis und Exploration
  • SQL-Abfragen zur strukturierten Erzeugung analytischer Datensätze
  • Power-Query-Bereinigung und Typanpassung
  • Verteilungs- und Trendanalysen in pandas
  • Erkennen fehlender oder fehlerhafter Werte

Statistische Grundbegriffe
  • Lagemaße wie Mittelwert und Median
  • Streuungsmaße wie Varianz und Standardabweichung
  • Korrelationen zur Erkennung möglicher Einflussfaktoren
  • Ausreißererkennung für stabile Analysegrundlagen

Statistik in der Analyse
  • Vergleich unterschiedlicher Gruppen anhand statistischer Kennzahlen
  • Nutzung von Trendlinien zur Strukturierung zeitlicher Verläufe
  • Vorbereitung modellrelevanter Variablen
  • Bewertung der Datenqualität vor weiterführender Analyse

Darstellung und Dokumentation
  • Visualisierung statistischer Ergebnisse in Power BI
  • Erstellung konsistenter Kennzahlen mit DAX
  • Dokumentation der statistischen Schritte und Annahmen
  • Versionierung und Qualitätssicherung der Analyseprozesse