Costruirò pipeline ETL con pyspark e databricks

Alcune informazioni sono state tradotte automaticamente.

Nepal

Parlo Nepalese, Hindi, Inglese

Ingegnere dei dati

Sono un Data & Backend Engineer con più di 5 anni di esperienza nella creazione di pipeline ETL scalabili, piattaforme di dati cloud e sistemi backend robusti. La mia competenza spazia tra Python, PyS...
Informazioni su questo servizio

Ciao, sono Arbind Sah e posso aiutarti a costruire pipeline ETL scalabili, elaborare Big Data o ottimizzare sistemi basati su cloud.

Sono specializzato in Python, SQL e strumenti nativi del cloud per semplificare l'integrazione dei dati, l'automazione e l'analisi per aziende di tutte le dimensioni.


In cosa posso aiutarti:

-Progettazione e ottimizzazione di pipeline ETL & Data Workflow utilizzando PySpark e Databricks per trasformazioni di dati affidabili e pronte per la produzione.Soluzioni Utilizzano Redshift, BigQuery, Spark e Databricks per gestire grandi dataset in modo efficiente.

-Infrastruttura Cloud: Costruisci e gestisci infrastrutture su AWS (EC2, RDS, S3, Lambda) e GCP, inclusi deployment containerizzati con Docker.

-Ottimizzazione e sicurezza del database Migliora le prestazioni delle query, implementa robuste misure di sicurezza e garantisci la conformità agli standard del settore.

-Migrazione dei dati e riconciliazione dello schema Migra e consolidare dati tra PostgreSQL, MySQL e piattaforme cloud, gestendo mismatch di tipo, valori null e mapping complessi dello schema.


Con un forte focus su cloud computing, automazione dei dati e analisi, garantisco soluzioni di dati scalabili, sicure e ad alte prestazioni.

Contattami per ottimizzare i tuoi workflow di dati e massimizzare l'efficienza!

Destination Platform:

Google BigQuery

Databricks Lakehouse

Strumenti e piattaforme:

Airbyte

AWS Glue DataBrew

Il mio portfolio