Progetterò e costruirò il tuo data pipeline ETL ELT
Ingegnere di dati cloud
Informazioni su questo servizio
Hai problemi con flussi di dati disordinati, manuali o poco affidabili? Costruisco pipeline di dati pulite e automatizzate
che funzionano in modo affidabile, rispettando le scadenze, senza dover controllare continuamente.
Sono un Data Engineer che lavora professionalmente su pipeline ETL basate su Spark per dati finanziari,
con esperienza pratica in Python, PySpark, Airflow, PostgreSQL e AWS.
COSA POSSO COSTRUIRE PER TE:
pipeline ETL/ELT (API, database o fonti basate su file)
Airflow DAG per flussi di lavoro programmati e automatizzati
Validazione dei dati e controlli di qualità (controlli null, conteggio record, verifiche schema)
Pipeline PySpark per l'elaborazione di grandi dataset
Data warehousing e pipeline di reporting con PostgreSQL/MySQL
Ottimizzazione e pulizia di pipeline esistenti lente o poco affidabili
PERCHÉ LAVORARE CON ME:
- Scrivo pipeline pensate per essere eseguite in produzione, non solo una volta
- Comunicazione chiara: farò le domande giuste prima di scrivere una riga di codice
- Codice documentato, pronto per il passaggio (README + commenti), non una scatola nera
Non sei sicuro di cosa ti serve esattamente? Scrivimi con la tua fonte di dati e l'obiettivo finale, ti dirò
onestamente cosa è realistico e come lo affronterei.
Expertise:
Big data
•
Manipolazione dati
•
etl
•
Trasformazione
•
SQL
•
NoSQL
