Ich werde robuste und skalierbare Data-Pipelines mit pyspark, databricks und airflow aufbauen

Einige Informationen wurden automatisch übersetzt.

Indien

Ich spreche Englisch

Zertifizierter Dateningenieur

Ergebnisorientierter Data Engineer mit 4,5 Jahren Erfahrung in der Gestaltung, Entwicklung, Testung, Unterstützung und Optimierung skalierbarer ETL/ELT-Pipelines mit PySpark, Databricks, SQL, Python, ...
Über diesen Service

Benötigst du skalierbare, produktionsbereite Data-Pipelines? Ich erstelle leistungsstarke Datenarchitekturen mit Databricks, PySpark, SQL, Apache Airflow und Apache Kafka. Von einfachem Dateieinlesen bis hin zu komplexem Echtzeit-Streaming liefere ich optimierte, kosteneffiziente Cloud-Lösungen.


Was ich anbiete:

  • End-to-End ETL/ELT: Sichere Data-Pipelines mit PySpark und SQL.
  • Databricks-Optimierung: Delta Lake, Delta Live Tables (DLT) und Unity Catalog Einrichtung.
  • Orchestrierung: Automatisierte Apache Airflow DAGs mit Fehlerbehandlung.
  • Echtzeit-Streaming: Niedrig-latenz Event-Streaming via Apache Kafka.
  • Performance-Optimierung: Senkung deiner Cloud-Compute-Kosten durch optimierte Abfragen.


Warum du mich wählen solltest?

  • Produktionsreifer, sauberer und wiederverwendbarer Code.
  • Erfahrung mit Enterprise-Cloud (AWS / Azure).
  • Kostenlose Architektur-Dokumentation inklusive.



Zielplattform:

Snowflake

Databricks Lakehouse

Teradata

Amazon S3

Tools und Plattformen:

Fivetran

Kafka Connect

Microsoft SSIS