Pulirò, trasformerò e costruirò pipeline ETL

Alcune informazioni sono state tradotte automaticamente.

Kenya

Parlo Inglese, Swahili, Russo, Tedesco

Sussurratore di dati

Ho una vasta conoscenza in data science e analytics, Machine Learning, natural language processing, google ads e analytics. Utilizzo linguaggi come python, R e Julia.
Informazioni su questo servizio

Aiuto aziende e ricercatori a trasformare dati disordinati, incoerenti o grezzi in set di dati puliti, affidabili e pronti per l'analisi, con pipeline complete costruite in Python o R. Offro anche consulenza per team che hanno bisogno di consigli o di una seconda opinione piuttosto che (o in aggiunta a) lavori pratici di sviluppo.


Lavoro pratico di ingegneria

  • Pulire e validare set di dati disordinati (valori mancanti, voci corrotte, formati incoerenti, record duplicati)
  • Costruire pipeline ETL per automatizzare estrazione, trasformazione e caricamento dei dati da CSV, Excel, API o database
  • Normalizzare nomi di colonne incoerenti, tipi di dati e strutture provenienti da più fonti (integrazione dei dati)
  • Progettare modelli e schemi di dati per uno storage pulito e scalabile
  • Configurare e gestire data warehouse (Snowflake, BigQuery, Redshift)
  • Costruire pipeline di trasformazione con dbt e orchestrare esecuzioni ricorrenti con Apache Airflow
  • Archiviare e gestire i dati nel cloud (Amazon S3)
  • Governance dei dati: regole di validazione, controlli di qualità e standard di documentazione
  • Migrazione dei dati tra sistemi, formati o piattaforme
  • Gestire dati time-series: lacune, dropout di sensori, pattern stagionali, interpolazione
  • Previsioni di base e analisi delle tendenze sui dati time-series puliti

Lingua:

Inglese

Esperienza tecnica:

dbt (Data Build Tool)

Apache Airflow

Expertise:

Pipeline dati

Sviluppo ETL

Data warehousing

Settore:

Analisi dei dati

Servizi finanziari

Legale