Costruirò o ottimizzerò pipeline di dati pyspark databricks

Alcune informazioni sono state tradotte automaticamente.

Stati Uniti

Parlo Inglese, Hindi

Progettazione di sistemi AI agentic full-stack e automazione, MLOps

Ingegnere AI/ML full-stack e statistico applicato con 10 anni di esperienza in dati, ML e AI aziendale. Costruisco workflow agentic, sistemi RAG, modelli predittivi, pipeline di dati, API e strumenti ...
Informazioni su questo servizio

Hai bisogno di una pipeline PySpark o Databricks affidabile, scalabile e comprensibile?


Revisionerò, costruirò, fixerò o ottimizzerò una pipeline di dati limitata usando PySpark, Spark SQL, Delta Lake e Azure Databricks quando necessario.


Posso affrontare job lenti, shuffle eccessivi, skew nelle join, partizionamento, pruning, funzioni di finestra, caratteristiche temporali, elaborazione incrementale, Delta Lake, controlli sulla qualità dei dati e refactoring di Python UDF.


La tua consegna può includere codice corretto, risultati delle performance, implementazione della pipeline, controlli di validazione, linee guida per benchmark, documentazione e consegna tecnica.


Il mio lavoro recente include elaborazione distribuita su miliardi di record di package-network in Azure Databricks senza UDF Python. Mi concentro su miglioramenti spiegabili, manutenibili.


Le package coprono job definiti, sorgenti e trasformazioni. Costi cloud, credenziali di produzione, amministrazione della piattaforma e dashboard non correlate sono esclusi a meno che non siano inclusi in un'offerta personalizzata.


Contattami prima di ordinare con il codice, gli schemi, la scala dei dati, il runtime attuale e il risultato desiderato.

Lingua:

Inglese

Hindi

Esperienza tecnica:

Apache Spark

Databricks

Snowflake

Expertise:

Pipeline dati

Sviluppo ETL

Settore:

Analisi dei dati

Legale

Marketing e pubblicità

Il mio portfolio