Sarò il tuo ingegnere mlops e llmops per distribuire modelli AI in produzione
Ingegnere AIML
Informazioni su questo servizio
Stai cercando di scalare i tuoi modelli di machine learning da un ambiente locale a un sistema affidabile e pronto per la produzione? Un notebook di codice disordinato non è un prodotto! Ti aiuterò ad automatizzare, ottimizzare e distribuire in modo sicuro i tuoi modelli di AI e Data Science in ambienti cloud protetti.
Sono specializzato nella creazione di pipeline end-to-end di MLOps e LLMOps che riducono i costi delle API, migliorano il tempo di attività del sistema e automatizzano il controllo delle versioni.
Servizi che offro:
- Sviluppo API: Trasformare i modelli in servizi web scalabili usando FastAPI, Flask o vLLM.
- Containerizzazione & Orchestrazione: Configurazione completa di Docker e scalabilità con Kubernetes.
- Pipeline CI/CD: Ri-allenamento e distribuzione automatizzata dei modelli tramite GitHub Actions o GitLab CI.
- Architettura Cloud: Configurazione e setup su AWS, Google Cloud Platform (GCP) o Microsoft Azure.
- Soluzioni LLMOps: Configurazione di database vettoriali (Pinecone, ChromaDB), ricerca semantica e pipeline RAG.
- Monitoraggio & Avvisi: Implementazione di dashboard complete con Prometheus e Grafana per il tracciamento dello stato del sistema. [1, 2, 3, 4, 5]
La stack che uso:
Python, Docker, Kubernetes, AWS, GCP, Azure, FastAPI, MLflow, Hugging Face, LangChain, Pinecone.
Per favore
Linguaggio di programmazione:
Python
•
SQL
Framework:
Scikit-learn
•
Google ML Kit
•
keras
•
PyTorch
•
Panda
