Costruirò pipeline ETL, ELT di dati con python, spark, airflow e dbt

Alcune informazioni sono state tradotte automaticamente.

Pakistan

Parlo Inglese

Ingegnere di dati e AI, Python, PySpark, Airflow e Cloud ETL

Hai bisogno di dati affidabili ma sei bloccato con pipeline rotte? Aiuto le aziende a costruire workflow ETL/ELT robusti che funzionano davvero. Sono un Data Engineer specializzato in infrastrutture c...
Informazioni su questo servizio

Su questo servizio:

Hai bisogno che i tuoi dati vengano puliti, trasformati e fatti fluire in modo affidabile dal sorgente alla destinazione? Costruisco pipeline ETL/ELT usando strumenti moderni di data engineering come Python, PySpark, SQL, Apache Airflow, dbt e Databricks, seguendo l'architettura Medallion (Bronze/Silver/Gold) per livelli di dati puliti e pronti per la produzione.

Recentemente ho realizzato una pipeline che raccoglie dati in tempo reale tramite API, li gestisce con Airflow con avvisi automatici in caso di fallimento, li trasforma attraverso più di 10 modelli dbt con oltre 60 test di qualità dei dati, e li visualizza in una dashboard Power BI più una pipeline Databricks separata che processa dati di e-commerce end-to-end con PySpark.

Cosa offro:

  • Progettazione e sviluppo di pipeline ETL/ELT (batch)
  • Pulizia, convalida e test di qualità dei dati
  • Implementazione dell'architettura Medallion (Bronze/Silver/Gold)
  • Orchestrazione con Apache Airflow
  • Trasformazione dei dati con dbt, SQL, PySpark
  • Sviluppo di pipeline Databricks
  • Ingestione dati tramite API
  • Integrazione con dashboard (Power BI)

Perché lavorare con me:

  • Progetti reali e verificabili, ogni consegna è supportata da un repository pubblico su GitHub
  • Comunicazione chiara, tempi realistici
  • Codice pulito, documentato e in stile produzione, non script usa e getta

Destination Platform:

PostgreSQL

•

Amazon S3

•

Altro

Strumenti e piattaforme:

Azure data factory

•

Altro

Il mio portfolio