Ich werde ETL-Pipelines mit Databricks und Pyspark aufbauen
Dateningenieur
Über diesen Service
Hast du Schwierigkeiten mit unordentlichen Daten, kaputten Pipelines oder Dashboards, die nicht die wahre Geschichte erzählen? Ich kann dir helfen.
Ich bin ein Data Engineer mit über 4 Jahren praktischer Erfahrung im Design, Bau und der Optimierung von End-to-End-Datenpipelines und Cloud-Datenplattformen.
WAS ICH FÜR DICH TUN KANN:
- Aufbau und Orchestrierung von ETL/ELT-Pipelines mit Apache Airflow
- Design und Verwaltung von Cloud-Datenlagern auf Snowflake und Databricks
- Schreiben von effizienten, produktionsreifen SQL- und Python-Code (PySpark) für groß angelegte Datenumwandlungen
- Migration alter Workflows (z.B. Hive/Oozie) zu modernen Databricks/Airflow-Pipelines
- Reinigung, Transformation und Modellierung roher Daten in analytische Tabellen
- Optimierung bestehender Pipelines für bessere Performance (Partitionierung, Caching, inkrementelle Loads)
- Erstellung von Dashboards in Power BI, Tableau oder Qlik auf Basis deiner Pipeline
WARUM MIT MIR ZUSAMMENARBEITEN:
- Praxiserfahrung im gesamten Daten-Stack von Ingestion bis Dashboard
- Klare Kommunikation während des gesamten Projekts, nicht nur Code-Lieferung
- Ich erkläre, was ich gebaut habe und warum, damit du nie im Dunkeln tappst, wenn es um die Wartung einer Black Box geht

