Costruirò pipeline ETL scalabili su databricks usando pyspark sql
Ingegnere dei dati e costruttore di sistemi AI, con 10 anni di esperienza
Informazioni su questo servizio
Hai bisogno di una pipeline Databricks affidabile invece di notebook fragili e processi manuali di dati?
Sono un data engineer con 9 anni di esperienza professionale nella creazione di pipeline ETL, piattaforme dati e soluzioni di analytics. Lavoro con Databricks, PySpark, Spark SQL, Delta Lake, Python e servizi cloud di dati per trasformare dati grezzi in dataset puliti e pronti per l'analisi.
Posso aiutarti con:
- Notebook Databricks usando PySpark e Spark SQL
- Sviluppo di pipeline batch ETL e ELT
- Architettura lakehouse Bronze, Silver e Gold
- Tabelle Delta Lake, MERGE e caricamenti incrementali
- Pulizia, trasformazione e convalida dei dati
- Configurazione di workflow e job
- Debugging e miglioramenti delle performance
- Commenti chiari nel codice e documentazione tecnica
Riceverai codice sorgente manutenibile, logica di pipeline chiaramente definita e documentazione pratica per gestire la soluzione.
Contattami tramite Fiverr prima di ordinare il pacchetto Premium o qualsiasi progetto che coinvolga accesso in produzione, streaming, configurazione infrastrutture, dati sensibili o scadenze urgenti.
Warehouse Platform:
Snowflake
•
BigQuery
•
Databricks
Tipo di progetto:
New Build

