Costruirò pipeline ETL in Python per il tuo data warehouse
Internazionale di Product Engineering
Informazioni su questo servizio
Sono uno studente di Ingegneria Informatica con esperienza pratica nella creazione di pipeline ETL e soluzioni di data engineering usando Python, SQL e Databricks. Attraverso tirocini reali, ho sviluppato servizi backend e API REST che elaborano grandi quantità di dati (oltre 120 milioni di record), integrato Databricks, Unity Catalog e Delta Tables nei flussi di lavoro di produzione, e implementato pipeline di validazione e pulizia dei dati per team di ingegneria.
Ciò che offro:
Progettazione e sviluppo di pipeline ETL (estrazione, trasformazione, caricamento)
Connessione alle fonti di dati (database, API, file)
Pulizia, formattazione e validazione dei dati
Workflow con Databricks e Delta Table
Integrazione API per flussi di dati automatizzati
Codice pulito, documentato e riutilizzabile
Mi concentro sulla scrittura di pipeline affidabili, ben strutturate e facili da mantenere, non solo di script veloci.
Comunico chiaramente durante tutto il progetto e consegno puntualmente.
Tecnologia:
Apache Spark
•
Java
•
Python
•
R
•
SQL
•
Databricks
Il mio portfolio
FAQ
Traduzione automatica.
Lavori con data warehouse diversi da Databricks?
Databricks è la mia principale competenza. Per altre piattaforme, contattami prima così posso confermare la compatibilità. Ma posso lavorarci, se mi ci sento a mio agio.
Riceverò il codice sorgente?
Sì, incluso nel pacchetto Premium (o come extra).
Puoi gestire più fonti di dati?
Sì — i pacchetti Standard e Premium supportano più fonti.
Di quali informazioni hai bisogno per iniziare?
Le tue fonti di dati, il target/warehouse di destinazione e qualsiasi logica di trasformazione specifica.
