Costruirò pipeline di dati robuste e scalabili usando pyspark, databricks e airflow

Alcune informazioni sono state tradotte automaticamente.

India

Parlo Inglese

Ingegnere dei dati certificato

Ingegnere di dati orientato ai risultati con 4,5 anni di esperienza nella progettazione, sviluppo, testing, supporto e ottimizzazione di pipeline ETL/ELT scalabili usando PySpark, Databricks, SQL, Pyt...
Informazioni su questo servizio

Hai bisogno di pipeline di dati scalabili e pronte per la produzione? Costruisco architetture di dati ad alte prestazioni usando Databricks, PySpark, SQL, Apache Airflow e Apache Kafka. Dall'ingestione semplice di file a streaming complessi in tempo reale, fornisco soluzioni cloud ottimizzate e convenienti.


Cosa offro:

  • ETL/ELT End-to-End: pipeline di dati sicure usando PySpark e SQL.
  • Ottimizzazione Databricks: configurazione di Delta Lake, Delta Live Tables (DLT) e Unity Catalog.
  • Orchestrazione: DAG di Apache Airflow automatizzati con gestione degli errori.
  • Streaming in tempo reale: streaming di eventi a bassa latenza tramite Apache Kafka.
  • Ottimizzazione delle prestazioni: riduci i costi di calcolo cloud con query ottimizzate.


Perché scegliermi?

  • Codice di livello produzione, pulito e riutilizzabile.
  • Esperienza in cloud aziendale (AWS / Azure).
  • Documentazione architetturale gratuita inclusa.



Destination Platform:

Snowflake

Databricks Lakehouse

Teradata

Strumenti e piattaforme:

Fivetran

Kafka Connect

Microsoft SSIS