Costruirò data warehouse e ottimizzerò pipeline ETL di BigQuery su Google Cloud
Informazioni su questo servizio
Costruirò le tue pipeline di dati su Google Cloud e ridurrò la tua fattura di BigQuery.
Sono un data engineer che ha gestito l'intera stack di BigQuery in produzione, attualmente Lead/Senior Data Engineer, dove ho ridotto la spesa mensile di BigQuery del 96% (da 13K$ a 500$) mentre il volume delle query è triplicato, ridisegnando schemi e ottimizzando le query.
Le cose che faccio:
- Costruire pipeline ETL in BigQuery da API, esportazioni GA4/Firebase, GCS o database
- Unificare GA4, Firebase, Adjust, RevenueCat, Google Ads in un modello BigQuery unico
- Ridurre i costi di BigQuery tramite ridisegno degli schemi, partizionamento/clustering, ottimizzazione delle query
- Impostare orchestrazioni programmate (Airflow, Cloud Composer, Pub/Sub)
- Costruire layer di trasformazione con Dataform
- Automatizzare i workflow di reporting con Python e API
- Impostare i Billing Kill Switch per ogni progetto
- Creare e ottimizzare data warehouse e data lakes
- Costruire dashboard direttamente dal warehouse
Come lavoro: condividi l'accesso in lettura a GCP, verifico i costi di pipeline/query, costruisco o rifaccio e convalido, ti fornisco documentazione e una call di consegna.
Strumenti: GCP, BigQuery, Cloud Storage, Pub/Sub, Airflow, Dataform, GA4, Firebase, SQL, Python.
- Contattami prima se il tuo setup è non standard.
Lingua:
Inglese
Esperienza tecnica:
Google BigQuery
Settore:
Analisi dei dati
FAQ
Traduzione automatica.
Avrai bisogno di accesso billing/admin al mio progetto GCP?
No, ho bisogno solo dei ruoli IAM specifici per il lavoro in scope (ad esempio BigQuery Data Editor, Job User). Ti dirò esattamente cosa concedere.
Puoi garantire una riduzione dei costi del % specifico?
Ogni ambiente è diverso, quindi non prometto un numero prima di aver verificato i tuoi pattern di query e schema — ma la riduzione dei costi è di solito la prima cosa che controllo.
Lavori con strumenti al di fuori dello stack Google (AWS, Snowflake, dbt)?
La mia esperienza più approfondita è con GCP/BigQuery, ma sono a mio agio con pattern generali di ETL/orchestrazione, contattami se il tuo stack è misto.
Puoi configurarlo in modo che funzioni senza che io intervenga più?
Sì, i pacchetti Standard e Premium includono orchestrazioni programmate in modo che le pipeline funzionino automaticamente.

