Ich entwerfe und baue deine AWS Data Lake Architektur auf AWS
Leitender Dateningenieur
Über diesen Service
Hast du Schwierigkeiten mit einem langsamen, unordentlichen oder gar nicht vorhandenen Data Lake auf AWS? Ich helfe Unternehmen, skalierbare und produktionsbereite Data Lake Architekturen mit S3, Glue, EMR und Athena zu entwerfen und aufzubauen – genau das gleiche Stack, den ich täglich für die Datenengineering-Leitung eines Bank- und Finanzdienstleistungs-Kunden mit Multi-Terabyte-Datenlake verwende.
Egal, ob du von Grund auf neu anfängst oder eine bestehende Lösung verbessern möchtest, ich kann bei folgendem helfen:
Design der Data Lake Architektur (Bronze-Analytikschichten)
AWS Glue Catalog & Cross-Account-Zugriff einrichten
Query-Optimierung für Athena/Presto
Groß angelegte S3/Parquet-Datenpipeline-Design
ETL-Pipeline-Empfehlungen mit Spark
Ich habe Pipelines entworfen, die über 100 GB Daten verarbeiten, mit zweiwöchentlichen Aktualisierungszyklen, Cross-Account-Glue-Catalog-Probleme gelöst und Legacy-SQL-Server-Logik in Athena-kompatible Abfragen umgewandelt – echte Produktionsprobleme, keine Tutorial-Arbeiten.
Lass uns über dein Daten-Setup sprechen, und ich helfe dir, etwas zu bauen, das skaliert.
Sprache:
Englisch
•
Hindi
Technische Expertise:
Apache-Funken
•
Amazon S3
•
Andere
Industrie:
Datenanalyse

