Farò pulizia dei dati, data wrangling, visualizzazione usando le librerie di data science di python
Specialista informatico e ingegnere informatico
Livello 2
Ha soddisfatto criteri di prestazioni elevate e ha una comprovata esperienza nel soddisfare le aspettative dei clienti.
Informazioni su questo servizio
Pulisco, organizzo e visualizzo dataset usando la core data science stack di Python: Pandas, NumPy, Matplotlib e Seaborn (PySpark disponibile per dataset più grandi).
Ciò che gestisco:
- Valori mancanti, duplicati, formattazione incoerente e correzioni di dtype
- Unione/riformattazione di dati provenienti da più fonti (CSV, Excel, JSON, SQL)
- Analisi esplorativa e visualizzazioni chiare e pronte per la presentazione
- Audit dei modelli per verificare la correttezza e l'assenza di bias nelle pipeline esistenti
- Raccomandazioni su tecnologia/librerie adatte al tuo dataset e obiettivo specifico
Per chi è adatto: fondatori, analisti e ricercatori che hanno dati grezzi o disordinati e ne hanno bisogno per trasformarli in qualcosa di utilizzabile, come un dataset pulito, un set di grafici o un riepilogo dei risultati per gli stakeholder.
Processo: inviami il tuo dataset e il tuo obiettivo, io lo pulisco e analizzo, tu ricevi un notebook documentato (o una presentazione su Premium) con risultati chiari prima/dopo.
Scrivimi prima di ordinare se il dataset è grande o l'analisi non standard, sono felice di definire prima il scope.
Linguaggio di programmazione:
Python
Tecnologia:
Python
•
tensorflow
•
PyTorch
•
opencv
•
keras
•
scikit-learn

