Ich baue produktionsbereite Datenpipelines mit Apache Spark und Kafka

Einige Informationen wurden automatisch übersetzt.

Philippinen

Ich spreche Englisch

Senior FullStack Softwareentwickler

Ich bin ein erfahrener Full-Stack-Softwareingenieur mit 12 Jahren Erfahrung in der Entwicklung von Unternehmensanwendungen im Bereich Banking und Finanzdienstleistungen. Ich spezialisiere mich auf Jav...
Über diesen Service

Ich erstelle Datenpipelines, die in der Produktion standhalten, nicht nur im Happy Path.

Zwölf Jahre im Bank- und Finanzdienstleistungsbereich bedeuten, dass ich die meiste Zeit mit den unspektakulären Teilen verbracht habe: doppelte Datensätze, verspätet eintreffende Daten, Schemaänderungen, die alles downstream zerbrechen, und Jobs, die sicher neu gestartet werden können. Das ist der Unterschied zwischen einer Pipeline, die in einer Demo funktioniert, und einer, die du einfach laufen lassen kannst.

Womit ich arbeite: Apache Spark, Kafka, Avro, Apache Iceberg, PostgreSQL, Java, Python, auf GCP und Kubernetes.

Typische Aufgaben, die ich übernehme:

  • Batch- oder Streaming-ETL von Quellsystemen in ein Warehouse oder einen Lake
  • Fragile Skripte in ordentliche Spark-Jobs umwandeln
  • Kafka-Consumer und -Producer mit sinnvollem Fehler- und Retry-Handling
  • Pipelines reparieren, die langsam, instabil sind oder Daten stillschweigend verlieren

Ich erkläre, was ich mache, in einfachem Englisch, und sage dir ehrlich, ob dein Problem eine einfachere Lösung braucht als die, die du angefragt hast.

Schreib mir vor der Bestellung mit deinen Datenquellen und grobem Volumen, und ich sage dir, welches Paket passt oder ob ich die falsche Person für den Job bin.

Zielplattform:

Google BigQuery

Databricks Lakehouse

PostgreSQL

Tools und Plattformen:

Andere