Ich werde automatisierte ETL-Pipelines mit Python und SQL erstellen
Business Intelligence Ingenieur
Über diesen Service
Organisationen können Schwierigkeiten mit unordentlichen Daten haben, die in verschiedenen Systemen isoliert sind. In meinem Alltag bin ich dafür verantwortlich, diese Lücke zu überbrücken, die analytische Schicht des Unternehmens zu entwerfen und sie von Anfang bis Ende zu betreuen. Ich hoffe, kleineren Firmen oder unabhängigen Leuten dabei zu helfen, dasselbe zu erreichen.
Was ich anbiete:
- Deine Daten aus APIs, Datenbanken, Tabellen oder Dateien ziehen: REST, JSON, SQL Server, Postgres, MySQL, BigQuery, Redshift
- Sie bereinigen, Entitäten über Systeme hinweg auflösen, bei denen die Identifikatoren unterschiedlich sind, und validieren
- Sie richtig modellieren, damit die Zahlen auch bei Fragen standhalten
- Automatisieren: tägliche inkrementelle Loads, idempotente Upserts, Rollback bei jedem Schreibvorgang
- Auf Wunsch das Power BI Dashboard darüber aufbauen
Stack: Python, fortgeschrittenes SQL, PySpark, dbt, Databricks, Microsoft Fabric, AWS, Power BI.
Sag mir, was du erreichen möchtest, und wir arbeiten von dort aus!
Technologie:
Python
•
SQL
FAQ
Automatische Übersetzung
Was brauchst du von mir, um anzufangen?
Zugriff auf Musterdateien oder Beispieldateien deiner Quellen, sowie eine Beschreibung dessen, was du am Ende sehen möchtest. Bei API auch Zugangsdaten oder Dokumentation. Ich bestätige den Umfang, bevor du bestellst.
Wird das nach der Lieferung automatisch laufen?
Bei Standard und Premium ja — du bekommst ein geplantes Aktualisierungsskript und Setup-Dokumentation. Basic ist eine einmalige saubere Extraktion.
Bekomme ich den Quellcode?
Inklusive bei Standard und Premium. Als Extra bei Basic erhältlich.
Meine Daten sind unordentlich und inkonsistent über die Systeme hinweg. Ist das ein Problem?
Nein, das ist der normale Fall. Die Entitätenübergreifende Auflösung, bei der die Identifikatoren nicht übereinstimmen, ist ein routinemäßiger Teil der Arbeit.
