Ich werde AWS ETL-Pipelines mit airflow, spark und python aufbauen

Einige Informationen wurden automatisch übersetzt.

Mexiko

Ich spreche Spanisch, Englisch

Leitender Dateningenieur

Ich bin ein unabhängiger Data Engineer mit über 20 Jahren Erfahrung in der IT und mehr als 10 Jahren Spezialisierung auf große Datenplattformen. Ich entwerfe, baue und optimiere ETL/ELT-Pipelines, S3-...
Über diesen Service

Senior Data Engineer mit über 10 Jahren Erfahrung im Aufbau von Produktions-ETL für Fortune 500 Kunden (Expedia, Ford, HP).

Ich erstelle zuverlässige, produktionsbereite AWS-Datenpipelines mit Python, PySpark, Airflow und Spark, keine Wegwerf-Skripte. Echter Ingenieurstil: Partitionierung, Broadcast-Joins, Orchestrierung und Tests.

Erfolgsgeschichte:

Reduzierte einen 64-stündigen HiveQL-Job auf unter 3 Stunden (95,6 % schneller)

500 TB von Hadoop auf AWS migriert, vollständig validiert

Eigene Multi-Tenant SaaS-Plattform von Anfang bis Ende aufgebaut und betrieben

Was du bekommst: sauberen, dokumentierten, deploybaren Code, den dein Team pflegen kann, kein Black Box.

Mit Sitz in Mexiko (US-Zeitzonen-Überlappung), Echtzeit-Zusammenarbeit während deiner Geschäftszeiten. Fließendes Englisch.

Nicht sicher, welches Paket passt? Schreib mir zuerst und ich kläre es mit dir ab.

Zielplattform:

Amazon Redshift

PostgreSQL

mySQL

Apache Hive

Tools und Plattformen:

AWS Glue DataBrew

Andere

Mein Portfolio