Costruirò pipeline ETL su AWS con airflow, spark e python

Alcune informazioni sono state tradotte automaticamente.

Messico

Parlo Spagnolo, Inglese

Ingegnere dati senior

Sono un ingegnere dati indipendente con oltre 20 anni di esperienza in IT e più di 10 specializzato in piattaforme di grandi volumi di dati. Progetto, costruisco e ottimizzo pipeline ETL/ELT, data lak...
Informazioni su questo servizio

Senior Data Engineer con oltre 10 anni di esperienza nella creazione di ETL di produzione per clienti Fortune 500 (Expedia, Ford, HP).

Costruisco pipeline di dati affidabili e pronte per la produzione su AWS usando Python, PySpark, Airflow e Spark, non script usa e getta. Ingegneria reale: partizionamento, broadcast joins, orchestrazione e testing.

Risultati ottenuti:

Ridotto un job HiveQL di 64 ore a meno di 3 ore (95,6% più veloce)

Migration di 500 TB da Hadoop ad AWS, completamente validata

Ho creato e gestito la mia piattaforma SaaS multi-tenant end-to-end

Ciò che ottieni: pipeline di codice pulito, documentato e deployabile che il tuo team può mantenere, non una scatola nera.

Basato in Messico (con sovrapposizione di fuso orario con gli Stati Uniti), collaborazione in tempo reale durante le tue ore lavorative. Inglese fluente.

Non sei sicuro di quale pacchetto fa per te? Scrivimi prima e lo valuterò insieme a te.

Destination Platform:

Amazon Redshift

PostgreSQL

MySQL

Strumenti e piattaforme:

AWS Glue DataBrew

Altro

Il mio portfolio