Ich erstelle eine Databricks ETL-Pipeline mit pyspark und spark sql

Einige Informationen wurden automatisch übersetzt.

Indien

Ich spreche Englisch

Dateningenieur und KI-Systembauer, 10 Jahre Erfahrung

Top bewertet auf Upwork: Ich bin Arun, ein Data Engineer und AI Consultant mit über 9 Jahren Erfahrung im Aufbau skalierbarer Datenplattformen, Analyse-Lösungen und AI-Anwendungen. Ich spezialisiere ...
Über diesen Service

Brauchst du eine zuverlässige Databricks-Pipeline statt zerbrechlicher Notebooks und manueller Datenverarbeitung?


Ich bin ein Data Engineer mit 9 Jahren Berufserfahrung im Aufbau von ETL-Pipelines, Datenplattformen und Analyse-Lösungen. Ich arbeite mit Databricks, PySpark, Spark SQL, Delta Lake, Python und Cloud-Datenservices, um Rohdaten in saubere, analysebereite Datensätze umzuwandeln.

Ich kann dir bei folgendem helfen:

  • Databricks Notebooks mit PySpark und Spark SQL
  • Batch ETL- und ELT-Pipeline-Entwicklung
  • Bronze-, Silver- und Gold-Lakehouse-Architektur
  • Delta Lake Tabellen, MERGE und inkrementelle Loads
  • Datenbereinigung, Transformation und Validierung
  • Workflow- und Job-Konfiguration
  • Debugging und Performance-Optimierung
  • Klare Code-Kommentare und technische Dokumentation


Du erhältst wartbaren Quellcode, klar definierte Pipeline-Logik und praktische Dokumentation für den Betrieb der Lösung.


Bitte schreibe mir vor der Bestellung des Premium-Pakets oder bei Projekten mit Produktionszugang, Streaming, Infrastrukturaufbau, sensiblen Daten oder dringenden Fristen über Fiverr eine Nachricht.

Warehouse-Plattform:

Snowflake

•

BigQuery

•

Databricks

Projektart:

New Build

Mein Portfolio

Meine weiteren Dienstleistungen im Bereich Datentechnik