Ich werde skalierbare databricks etl pipelines mit pyspark sql erstellen
Dateningenieur und KI-Systembauer, 10 Jahre Erfahrung
Über diesen Service
Brauchst du eine zuverlässige Databricks-Pipeline statt zerbrechlicher Notebooks und manueller Datenverarbeitung?
Ich bin ein Data Engineer mit 9 Jahren Berufserfahrung im Aufbau von ETL-Pipelines, Datenplattformen und Analyse-Lösungen. Ich arbeite mit Databricks, PySpark, Spark SQL, Delta Lake, Python und Cloud-Datenservices, um Rohdaten in saubere, analysebereite Datensätze umzuwandeln.
Ich kann dir bei folgendem helfen:
- Databricks Notebooks mit PySpark und Spark SQL
- Batch ETL- und ELT-Pipeline-Entwicklung
- Bronze-, Silver- und Gold-Lakehouse-Architektur
- Delta Lake Tabellen, MERGE und inkrementelle Loads
- Datenbereinigung, Transformation und Validierung
- Workflow- und Job-Konfiguration
- Debugging und Performance-Optimierung
- Klare Code-Kommentare und technische Dokumentation
Du erhältst wartbaren Quellcode, klar definierte Pipeline-Logik und praktische Dokumentation für den Betrieb der Lösung.
Bitte schreibe mir vor der Bestellung des Premium-Pakets oder bei Projekten mit Produktionszugang, Streaming, Infrastrukturaufbau, sensiblen Daten oder dringenden Fristen über Fiverr eine Nachricht.
Warehouse-Plattform:
Snowflake
•
BigQuery
•
Databricks
Projektart:
New Build

