Ich werde ETL-Datenpipelines mit PySpark und Databricks erstellen

Einige Informationen wurden automatisch übersetzt.

Nepal

Ich spreche Nepali, Hindi, Englisch

Dateningenieur

Ich bin ein Data & Backend Engineer mit über 5 Jahren Erfahrung beim Aufbau skalierbarer ETL-Pipelines, Cloud-Datenplattformen und robuster Backend-Systeme. Meine Expertise umfasst Python, PySpark, SQ...
Über diesen Service

Hallo, ich bin Arbind Sah, und ich kann dir dabei helfen, skalierbare ETL-Pipelines aufzubauen, Big Data zu verarbeiten oder cloud-basierte Systeme zu optimieren.

Ich spezialisiere mich auf Python, SQL und cloud-native Tools, um Datenintegration, Automatisierung und Analysen für Unternehmen jeder Größe zu vereinfachen.


Wobei ich dir helfen kann:

-ETL- & Data-Pipelines Design und Optimierung von ETL/ELT-Workflows mit PySpark und Databricks für zuverlässige, produktionsreife Datenumwandlung. Lösungen Nutze Redshift, BigQuery, Spark und Databricks, um große Datensätze effizient zu verarbeiten.

-Cloud-Infrastruktur: Infrastruktur auf AWS (EC2, RDS, S3, Lambda) und GCP aufbauen und verwalten, inklusive containerisierter Deployments mit Docker.

-Datenbank-Optimierung & Sicherheit Verbesserung der Abfrageleistung, Implementierung robuster Sicherheitsmaßnahmen und Einhaltung von Branchenstandards.

-Datenmigration & Schema Abgleich Migration und Konsolidierung von Daten über PostgreSQL, MySQL und Cloud-Plattformen, inklusive Umgang mit Typ-Mismatches, Null-Werten und komplexem Schema-Mapping.


Mit starkem Fokus auf Cloud-Computing, Datenautomatisierung und Analytik sorge ich für skalierbare, sichere und leistungsstarke Datenlösungen.

Kontaktiere mich, um deine Daten-Workflows zu optimieren und maximale Effizienz zu erreichen!

Zielplattform:

Google BigQuery

Databricks Lakehouse

PostgreSQL

Tools und Plattformen:

Airbyte

AWS Glue DataBrew

Mein Portfolio