Ich werde PySpark- und Databricks-Datenpipelines erstellen

Einige Informationen wurden automatisch übersetzt.

Indien

Ich spreche Hindi, Englisch, Französisch, Spanisch

Unternehmensdateningenieur, der automatisierte Pipelines aufbaut und SQL optimiert

Data Engineer | Python | SQL | ETL | Spark Ich erstelle produktionsbereite Datenpipelines, ETL-Workflows und Datenlösungen mit Python, SQL, PySpark, Apache Spark, Airflow, Databricks, Snowflake, Trino...
Über diesen Service

Brauchst du Hilfe bei der Verarbeitung großer Datensätze mit PySpark oder Databricks?


Ich erstelle skalierbare Datenpipelines mit PySpark, Apache Spark und Databricks für Datenumwandlung, Verarbeitung und Analyse.


Ich kann bei folgenden Aufgaben helfen:

  • PySpark-Datenumwandlungen und -bereinigungen
  • Databricks-Notebooks und Workflows
  • ETL/ELT-Pipeline-Entwicklung
  • Groß angelegte Datenverarbeitung
  • Joins, Aggregationen, Filterung und Duplikatentfernung
  • Inkrementelle und Batch-Verarbeitung
  • Datenvalidierung und Qualitätskontrollen
  • Performance-Optimierung
  • Daten in Data Warehouses und Datenbanken laden

Ich lege Wert auf saubere, wartbare und effiziente Pipelines mit klarer Dokumentation.


Kontaktiere mich vor der Bestellung bei komplexen Projekten, damit ich deine Daten und Anforderungen besser verstehe.

Warehouse-Plattform:

Snowflake

•

Azure Synapse

•

Databricks

Projektart:

New Build

Mein Portfolio

Meine weiteren Dienstleistungen im Bereich Datentechnik