Costruirò pipeline ETL per l'ingegneria dei dati usando Apache Airflow

Alcune informazioni sono state tradotte automaticamente.

Bangladesh

Parlo Bengali, Inglese

Junior Data Scientist, ML Engineer, Python, Pipelines ETL

Sono un Data Scientist e Data Engineer, recentemente laureato all'AIUB (CGPA: 3.98/4.00), con una pubblicazione in conferenza IEEE sottoposta a peer review e doppie certificazioni DataCamp, Certified ...
Informazioni su questo servizio

I tuoi dati sono in API o file senza un modo automatizzato per raccoglierli e archiviarli? Costruisco pipeline ETL pronte per la produzione e workflow di data engineering usando Apache Airflow 3, Python e SQL che estraggono, trasformano e caricano i tuoi dati secondo un programma, completamente automatizzati, senza lavoro manuale.


Cosa consegno:

  • Pipeline automatizzata con task indipendenti di estrazione, trasformazione e caricamento
  • Apache Airflow 3 con TaskFlow API e pianificazione giornaliera
  • Stack Docker multi-container per un deployment pulito e riproducibile
  • Database PostgreSQL o MySQL con record strutturati e interrogabili
  • Codice sorgente completo consegnato tramite GitHub


Perché scegliere me? Ho una pubblicazione peer-reviewed in una conferenza IEEE, doppie certificazioni DataCamp (Certified Data Scientist e Certified Associate Data Scientist) e uno stage di ricerca presso un laboratorio di AI nel Regno Unito. La mia pipeline ETL funziona in produzione in tempo reale, accumulando oltre 365 record strutturati all'anno senza intervento manuale.


Collaboro con: API REST e fonti di dati basate su file, caricando i dati in database SQL come PostgreSQL o MySQL.


Nota: Ti prego di scrivermi prima di ordinare per discutere la tua fonte di dati e le tue esigenze.

Destination Platform:

PostgreSQL

MySQL

Strumenti e piattaforme:

Altro

Il mio portfolio