Ich werde ETL-Pipelines mit Databricks und Pyspark aufbauen

Einige Informationen wurden automatisch übersetzt.

Indien

Ich spreche Englisch

Dateningenieur

Data Engineer mit über 4 Jahren Erfahrung im Aufbau skalierbarer ETL/ELT-Pipelines und Cloud-Datenplattformen. Kompetent in Databricks, Snowflake, Apache Airflow, PySpark, SQL und Python — mit praktis...
Über diesen Service

Hast du Schwierigkeiten mit unordentlichen Daten, kaputten Pipelines oder Dashboards, die nicht die wahre Geschichte erzählen? Ich kann dir helfen.


Ich bin ein Data Engineer mit über 4 Jahren praktischer Erfahrung im Design, Bau und der Optimierung von End-to-End-Datenpipelines und Cloud-Datenplattformen.


WAS ICH FÜR DICH TUN KANN:

- Aufbau und Orchestrierung von ETL/ELT-Pipelines mit Apache Airflow

- Design und Verwaltung von Cloud-Datenlagern auf Snowflake und Databricks

- Schreiben von effizienten, produktionsreifen SQL- und Python-Code (PySpark) für groß angelegte Datenumwandlungen

- Migration alter Workflows (z.B. Hive/Oozie) zu modernen Databricks/Airflow-Pipelines

- Reinigung, Transformation und Modellierung roher Daten in analytische Tabellen

- Optimierung bestehender Pipelines für bessere Performance (Partitionierung, Caching, inkrementelle Loads)

- Erstellung von Dashboards in Power BI, Tableau oder Qlik auf Basis deiner Pipeline


WARUM MIT MIR ZUSAMMENARBEITEN:

- Praxiserfahrung im gesamten Daten-Stack von Ingestion bis Dashboard

- Klare Kommunikation während des gesamten Projekts, nicht nur Code-Lieferung

- Ich erkläre, was ich gebaut habe und warum, damit du nie im Dunkeln tappst, wenn es um die Wartung einer Black Box geht


Sprache:

Englisch

Technische Expertise:

dbt (Datenerstellungstool)

Apache-Funken

Expertise:

Datenpipelines

ETL-Entwicklung

Data-Warehousing

Industrie:

Datenanalyse

Mein Portfolio