Deployo e gestisco infrastrutture mlops, llm e gpu su aws e kubernetes

Alcune informazioni sono state tradotte automaticamente.

India

Parlo Hindi, Inglese

19 ordini completati

Senior AI DevOps Engineer: AWS, Kubernetes, API ComfyUI, DevSecOps

Ingegnere AI DevSecOps e Cloud Infrastructure, 4 anni di esperienza nella creazione di sistemi di produzione. Fornisco ciò che la maggior parte dei progetti AI manca: l'infrastruttura sottostante. La...
Informazioni su questo servizio

Metto i modelli AI in produzione e li mantengo attivi. Uno script di training non è un prodotto. Un servizio monitorato, versionato e con autoscaling sì.

COSA COSTRUISCO
Pipeline MLOps: tracciamento con MLflow o Weights and Biases, registro dei modelli, retraining automatico e rollout sicuro
Servizio LLM: vLLM, Ollama, TGI e modelli Hugging Face dietro un'API compatibile con OpenAI
Infrastruttura GPU: AWS EC2 g5 e g6, EKS con gruppi di nodi GPU, RunPod e Vast.ai, spot instances e autoscaling per ridurre i costi
Container: Docker, Kubernetes, Helm, scheduling GPU, controlli di salute e rollout senza downtime
CI/CD per modelli e codice: GitHub Actions, Jenkins, ArgoCD e GitOps
Osservabilità: Prometheus, Grafana, tracciamento richieste, dashboard di latenza e costi per token
Sicurezza: IAM con privilegi minimi, endpoint VPC privati, gestione segreti e SSL
COSA OTTIENI
Infrastruttura funzionante, il codice Terraform o Helm che possiedi, documentazione del runbook e una call di consegna per permettere al tuo team di gestirla senza di me.
Quattro anni in DevOps e infrastrutture AI. Raccontami il tuo modello, traffico previsto e cloud, e ti farò una stima realistica del costo mensile prima di ordinare. Lavoro in orari US.

Strumenti:

Kubernetes

Docker

Amazon EKS

Framework:

Terraform

Ansible

Provider Cloud:

Amazon Web Services

Piattaforma Google Cloud

Linguaggio di programmazione:

Bash

Go

Python

Expertise:

Installazione

Migrazione

Debug

Altri servizi della categoria Ingegneria DevOps offerti da me