Die effiziente Verarbeitung großer Datenmengen erfordert den gezielten Einsatz datenwissenschaftlicher Techniken. Im Kurs Data Science: Techniken zur Optimierung großer Datenmengen stehen automatisierte Workflows, analytische Methoden und Modellierungsansätze im Mittelpunkt, die für die Umsetzung skalierbarer Datenprojekte notwendig sind.

Themen und Methoden
  • Aufbau leistungsfähiger Datenpipelines
  • Entwicklung strukturierter Prozesse zur Harmonisierung und Transformation unterschiedlicher Datenquellen, um Analyseabläufe zu automatisieren und die Datenqualität langfristig sicherzustellen
  • Einsatz von SQL zur effizienten Analyse umfangreicher relationaler Daten
  • Nutzung optimierter Abfragen, Joins und Aggregationen zur strukturierten Aufbereitung von Daten für datengetriebene Entscheidungen, Machine Learning und Predictive Analytics
  • Visualisierung von Analyseergebnissen mittels Power BI
  • Erstellung interaktiver Dashboards und Nutzung von DAX-Funktionen zur anschaulichen Darstellung komplexer Zusammenhänge und Erleichterung der Kommunikation analytischer Erkenntnisse
  • Explorative Datenanalyse und statistische Verfahren zur systematischen Erkennung von Mustern und Trends
  • Durchführung von Hypothesentests zur strukturierten Überprüfung von Fragestellungen aus verschiedenen Anwendungsbereichen
  • Einführung in das maschinelle Lernen
  • Training von Modellen und Verbesserung deren Leistung mit geeigneten Verfahren
  • Einsatz datenwissenschaftlicher Methoden zur Unterstützung operativer und strategischer Entscheidungen