Statistik unterstützt die Analyse und Modellierung, indem sie Daten strukturiert beschreibt und prüft. Mit SQL, Power Query und Python werden Daten gesammelt, bereinigt und aufbereitet. Statistische Kennzahlen wie Verteilungen, Lage- und Streuungsmaße sowie Korrelationen helfen, relevante Muster zu erkennen. Diese Grundlagen dienen als Ausgangspunkt für Data-Science-Modelle und analytische Fragestellungen. Ziel ist eine belastbare Grundlage für Entscheidungen und Modellprozesse.
Datenbasis und Exploration- SQL-Abfragen zur strukturierten Erzeugung analytischer Datensätze
- Power-Query-Bereinigung und Typanpassung
- Verteilungs- und Trendanalysen in pandas
- Erkennen fehlender oder fehlerhafter Werte
Statistische Grundbegriffe
- Lagemaße wie Mittelwert und Median
- Streuungsmaße wie Varianz und Standardabweichung
- Korrelationen zur Erkennung möglicher Einflussfaktoren
- Ausreißererkennung für stabile Analysegrundlagen
Statistik in der Analyse
- Vergleich unterschiedlicher Gruppen anhand statistischer Kennzahlen
- Nutzung von Trendlinien zur Strukturierung zeitlicher Verläufe
- Vorbereitung modellrelevanter Variablen
- Bewertung der Datenqualität vor weiterführender Analyse
Darstellung und Dokumentation
- Visualisierung statistischer Ergebnisse in Power BI
- Erstellung konsistenter Kennzahlen mit DAX
- Dokumentation der statistischen Schritte und Annahmen
- Versionierung und Qualitätssicherung der Analyseprozesse