Ich baue Datenlager auf und optimiere BigQuery ETL-Pipelines auf Google Cloud
Über diesen Service
Ich erstelle deine Google Cloud Datenpipelines und senke deine BigQuery-Rechnung.
Ich bin Dateningenieur, der die komplette BigQuery-Stack in der Produktion betreibt und derzeit Lead/Senior Data Engineer ist. Dabei habe ich die monatlichen BigQuery-Kosten um 96 % gesenkt (von 13.000 $ auf 500 $), während das Query-Volumen sich verdreifacht hat, durch Neugestaltung von Schemas und Optimierung von Abfragen.
Was ich mache:
- ETL-Pipelines in BigQuery aus APIs, GA4/Firebase-Exports, GCS oder Datenbanken erstellen
- GA4, Firebase, Adjust, RevenueCat, Google Ads in ein einheitliches BigQuery-Modell integrieren
- BigQuery-Kosten durch Schema-Neugestaltung, Partitionierung/Clustering und Abfrageoptimierung senken
- Geplante Orchestrierung einrichten (Airflow, Cloud Composer, Pub/Sub)
- Transformationsschichten mit Dataform aufbauen
- Automatisierte Berichts-Workflows mit Python und APIs erstellen
- Billing Kill Switches pro Projekt einrichten
- Datenlager und Data Lakes erstellen und optimieren
- Dashboards direkt aus dem Lager bauen
So arbeite ich: Du teilst Lesezugriff auf GCP, ich prüfe Pipeline- und Abfragekosten, ich baue oder refaktorisiere & validiere, du erhältst Dokumentation und einen Übergabegespräch.
Tools: GCP, BigQuery, Cloud Storage, Pub/Sub, Airflow, Dataform, GA4, Firebase, SQL, Python.
- Schreib mir zuerst, wenn dein Setup nicht standardmäßig ist.
Sprache:
Englisch
Technische Expertise:
Google BigQuery
Industrie:
Datenanalyse
FAQ
Automatische Übersetzung
Benötigst du Zugriff auf meine GCP-Billing/Administratorrechte?
Nein, ich brauche nur die spezifischen IAM-Rollen für den Arbeitsbereich (z.B. BigQuery Data Editor, Job User). Ich sage dir genau, was du gewähren sollst.
Kannst du eine bestimmte % Kostenreduktion garantieren?
Jede Umgebung ist anders, deshalb verspreche ich keine Zahl, bevor ich deine tatsächlichen Query-Muster und Schemas geprüft habe – aber Kostenreduktion ist meistens das Erste, worauf ich achte.
Arbeitest du mit Tools außerhalb des Google-Stacks (AWS, Snowflake, dbt)?
Meine tiefste Expertise liegt bei GCP/BigQuery, aber ich bin auch mit allgemeinen ETL- und Orchestrationsmustern vertraut. Schreib mir, wenn dein Stack gemischt ist.
Kannst du das so einrichten, dass es ohne mein Zutun läuft?
Ja, die Standard- und Premium-Pakete beinhalten geplante Orchestrierung, sodass Pipelines automatisch laufen.

