Progetterò e costruirò la tua architettura data lake su AWS
Ingegnere dati senior
Informazioni su questo servizio
Hai problemi con un data lake lento, disordinato o inesistente su AWS? Aiuto le aziende a progettare e costruire architetture di data lake scalabili e pronte per la produzione usando S3, Glue, EMR e Athena, lo stesso stack che utilizzo quotidianamente per guidare l'ingegneria dei dati di un cliente del settore bancario/servizi finanziari con un data lake multi-terabyte.
Che tu parta da zero o abbia bisogno di sistemare una configurazione esistente, posso aiutarti con:
Progettazione dell'architettura del data lake (livelli di analisi bronze)
Configurazione del AWS Glue Catalog e accesso cross-account
Ottimizzazione delle query Athena/Presto
Progettazione di pipeline di dati su larga scala con S3/Parquet
Raccomandazioni per pipeline ETL usando Spark
Ho progettato pipeline che gestiscono oltre 100 GB di dati con cicli di aggiornamento bisettimanali, risolto problemi di Glue Catalog cross-account e convertito logiche legacy di SQL Server in query compatibili con Athena, affrontando problemi reali di produzione, non lavori a livello tutorial.
Parliamo della tua configurazione dei dati e ti aiuterò a costruire qualcosa che possa scalare.
Lingua:
Inglese
•
Hindi
Esperienza tecnica:
Apache Spark
•
Amazon S3
•
Altro
Settore:
Analisi dei dati

