Ich werde Datenengineering und Big Data
Dateningenieur
Über diesen Service
Ich werde eine maßgeschneiderte ETL/ELT-Datenpipeline mit Python und SQL erstellen, um deine Daten zu extrahieren, zu transformieren, zu validieren und in Datenbanken oder Cloud-Datenlager wie BigQuery zu laden. Die Pipeline umfasst grundlegende Datenqualitätsprüfungen, Unit-Tests und klare Dokumentation.
Tools und Plattformen:
Google Cloud Dataflow
FAQ
Automatische Übersetzung
Welche Informationen benötigen Sie, um das Projekt zu starten?
Ich benötige Zugriff auf die Datenquelle oder einen Beispiel-Datensatz, das gewünschte Ziel sowie eine kurze Beschreibung der erwarteten Transformationen oder Geschäftsanforderungen. Bitte teile keine sensiblen Zugangsdaten direkt im Fiverr-Chat.
Welche Datenquellen und Ziele unterstützt du?
Ich kann mit Datenbanken und Cloud-Diensten wie PostgreSQL, MySQL, BigQuery und Google Cloud Storage arbeiten. Außerdem kann ich mit strukturierten Dateien wie CSV und JSON arbeiten.
Stellst du ETL- und ELT-Pipelines bereit?
Ja. Ich kann je nach deiner Datenarchitektur, deinen Anforderungen und der Zielplattform entweder ETL- oder ELT-Workflows entwerfen.
Enthält die Pipeline Datenqualitätsprüfungen?
Ja. Das Basic-Paket beinhaltet grundlegende Validierungen wie Null-Wert-Checks, Duplikaterkennung, Datentyp-Validierung und einfache Schema- oder Werteüberprüfungen.
Wird die Pipeline Tests und Dokumentation enthalten?
Ja. Die Pipeline umfasst grundlegende Unit-Tests und eine Dokumentation, die den Aufbau, Abhängigkeiten, Konfiguration und Ablauf erklärt.
Kannst du die Pipeline mit meiner bestehenden Datenbank oder Cloud-Umgebung verbinden?
Ja, vorausgesetzt, die erforderlichen Zugangs- und Verbindungsinformationen sind vorhanden. Die genaue Umsetzung hängt von der Quelle, dem Ziel und den Projektanforderungen ab.
