Distribuirò il tuo modello di AI avanzato su GPU serverless economiche

K
kstrdevelopment
K
kstrdevelopment
Ismael
Alcune informazioni sono state tradotte automaticamente.

Informazioni su questo servizio

Traduzione automatica.

Costruisco e ottimizzo backend di inferenza AI per app che hanno bisogno di una vera GPU, non solo di un wrapper intorno all'API di ChatGPT.

Ho distribuito e ottimizzato pipeline AI in produzione (elaborazione di immagini/video, modelli generativi stile face-swap) sulla infrastruttura GPU serverless di Modal, tra cui:

- Configurazione di istanze GPU/CPU (L4/T4) ottimizzata per costi e latenza

- Ottimizzazione di cold-start e warmup per ridurre i secondi di GPU sprecati

- Snapshot della memoria GPU per ridurre i tempi di cold-start

- Ottimizzazione della pipeline ~75% di riduzione del tempo di elaborazione su un carico di lavoro in produzione

- Gestione dei segnali e correzioni di affidabilità per lavori di inferenza di lunga durata

Scopri di più su Ismael

Ismael

Mobile App Developer

  • DaSpagna
  • Membro daago 2026
  • Tempo di risposta medio1 ora
  • Lingue

    Spagnolo, Inglese
Software engineer specializing in cross-platform mobile development and cloud backend integration. I design, build, and deploy production-ready mobile applications using Flutter, backed by scalable serverless architectures.

Traduzione automatica.