Costruirò pipeline ETL scalabili su databricks usando pyspark sql

Alcune informazioni sono state tradotte automaticamente.

India

Parlo Inglese

Ingegnere dei dati e costruttore di sistemi AI, con 10 anni di esperienza

Sono Arun, un Ingegnere dei dati e consulente AI con oltre 10 anni di esperienza nella creazione di piattaforme di dati scalabili, soluzioni di analisi e applicazioni AI. Mi specializzo in pipeline ET...
Informazioni su questo servizio

Hai bisogno di una pipeline Databricks affidabile invece di notebook fragili e processi manuali di dati?


Sono un data engineer con 9 anni di esperienza professionale nella creazione di pipeline ETL, piattaforme dati e soluzioni di analytics. Lavoro con Databricks, PySpark, Spark SQL, Delta Lake, Python e servizi cloud di dati per trasformare dati grezzi in dataset puliti e pronti per l'analisi.

Posso aiutarti con:

  • Notebook Databricks usando PySpark e Spark SQL
  • Sviluppo di pipeline batch ETL e ELT
  • Architettura lakehouse Bronze, Silver e Gold
  • Tabelle Delta Lake, MERGE e caricamenti incrementali
  • Pulizia, trasformazione e convalida dei dati
  • Configurazione di workflow e job
  • Debugging e miglioramenti delle performance
  • Commenti chiari nel codice e documentazione tecnica


Riceverai codice sorgente manutenibile, logica di pipeline chiaramente definita e documentazione pratica per gestire la soluzione.


Contattami tramite Fiverr prima di ordinare il pacchetto Premium o qualsiasi progetto che coinvolga accesso in produzione, streaming, configurazione infrastrutture, dati sensibili o scadenze urgenti.

Warehouse Platform:

Snowflake

BigQuery

Databricks

Tipo di progetto:

New Build

Il mio portfolio