Costruirò databricks delta lake lakehouse e architettura medallion

J
jesseantony
J
jesseantony
Jessay
Alcune informazioni sono state tradotte automaticamente.

Informazioni su questo servizio

Traduzione automatica.

Stai cercando di creare un data lakehouse moderno e scalabile su Databricks? Progetterò e implementerò un Delta Lake Lakehouse pronto per la produzione con architettura Medallion (strati Bronze, Silver, Gold).


Con oltre 4 anni di esperienza in Publicis Sapient e Alcon nella costruzione di piattaforme di dati aziendali, porto una profonda competenza in Databricks, PySpark e Delta Lake.


Ciò che costruirò per te:

  • Configurazione di Delta Lake con strati medallion Bronze/Silver/Gold ottimizzati
  • Pipeline PySpark per ingestion, trasformazione e aggregazione
  • Delta Live Tables (DLT) per pipeline dichiarative e auto-scalanti
  • Unity Catalog per una governance dei dati dettagliata e controllo degli accessi
  • <li Controlli sulla qualità dei dati, applicazione dello schema e transazioni ACID
  • Integrazione del ML feature store per workflow di machine learning
  • Ottimizzazione delle prestazioni: Z-ordering, partizionamento e compattazione dei file
  • Workflow automatizzati usando Databricks Jobs e cluster
  • Documentazione completa e consegna


Tecnologie: Databricks, PySpark, Delta Lake, Delta Live Tables, Unity Catalog, Azure Data Lake Storage, Apache Spark, SQL


Scrivimi per discutere delle tue esigenze!

Scopri di più su Jessay

Jessay

Senior Data Engineer: AWS, Azure, Spark, ETL Pipelines and Data Architecture

  • DaIndia
  • Membro daapr 2025
  • Tempo di risposta medio3 ore
  • Ultima consegna6 mesi
  • Lingue

    Malayalam, Inglese
Struggling with slow pipelines or messy data? I design and build scalable ETL pipelines that deliver real results. With 5+ years on AWS and Azure, I specialize in Databricks, Apache Spark, AWS Glue, and Azure Data Factory. I have built production-grade data warehouses, optimized Spark performance, and integrated Hadoop, Hive, and HBase environments. Stack: Python, PySpark, Scala, SQL, S3, Lambda, Step Functions, Azure Data Lake Gen2, Redshift, PostgreSQL. Ready to turn your raw data into clean, actionable insights.

Traduzione automatica.

Il mio portfolio

Tag correlati