Ich werde pyspark databricks datenpipelines bauen oder optimieren

Einige Informationen wurden automatisch übersetzt.

Vereinigte Staaten

Ich spreche Englisch, Hindi

FullStack Agentic AI Agenten-Design und Automatisierung, MLOps

Full-Stack AI/ML-Ingenieur und angewandter Statistiker mit 10 Jahren Erfahrung in Daten, ML und Enterprise AI. Ich entwickle agentische Workflows, RAG-Systeme, prädiktive Modelle, Datenpipelines, APIs...
Über diesen Service

Benötigst du eine zuverlässige, skalierbare und verständliche PySpark- oder Databricks-Pipeline?


Ich werde eine begrenzte Datenpipeline mit PySpark, Spark SQL, Delta Lake und Azure Databricks überprüfen, bauen, reparieren oder optimieren, wo es passend ist.


Ich kann langsame Jobs, zu viele Shuffle-Operationen, Join-Skew, Partitionierung, Pruning, Window-Funktionen, temporäre Features, inkrementelle Verarbeitung, Delta Lake, Datenqualitätsprüfungen und Python UDF-Refactoring angehen.


Deine Lieferung kann korrigierten Code, Performance-Ergebnisse, Pipeline-Implementierung, Validierungschecks, Benchmark-Richtlinien, Dokumentation und eine technische Übergabe umfassen.


Mein aktueller Arbeitsbereich umfasst verteilte Verarbeitung von Milliarden von Paket-Netzwerk-Datensätzen in Azure Databricks ohne Python UDFs. Ich konzentriere mich auf erklärbare, wartbare Verbesserungen.


Pakete decken definierte Jobs, Quellen und Transformationen ab. Cloud-Gebühren, Produktionszugänge, Plattformverwaltung und nicht verwandte Dashboards sind ausgeschlossen, es sei denn, sie sind in einem individuellen Angebot enthalten.


Bitte sende mir vor der Bestellung eine Nachricht mit Code, Schemas, Datenmenge, aktuellem Runtime und gewünschtem Ergebnis.

Sprache:

Englisch

Hindi

Technische Expertise:

Apache-Funken

Databricks

Snowflake

Expertise:

Datenpipelines

ETL-Entwicklung

Industrie:

Datenanalyse

Recht

Marketing & Werbung

Immobilien

Mein Portfolio