Auditerò il tuo agente AI e lo renderò pronto per la produzione
Ingegnere AI e architetto di soluzioni per RAG e agenti AI
Informazioni su questo servizio
Stai lanciando un agente AI o un'app LLM? Lo testo come farebbe un attaccante o in caso di incidente di produzione, poi ti dico esattamente cosa sistemare.
Sono un ingegnere AI che costruisce sistemi AI di produzione per una banca regolamentata, dove sicurezza, privacy e affidabilità sono requisiti fondamentali.
Ciò che controllo:
- Injection di prompt e jailbreak, diretti e nascosti in documenti o pagine web
- Perdita di dati: prompt di sistema, PII, segreti, dati di altri utenti
- Permessi di tool e API: cosa il tuo agente può fare e non dovrebbe
- Affidabilità: gestione degli errori, tentativi, timeout, cicli e fallback
- Valutazione: se la qualità delle risposte è misurata o solo sperata
- Logging, tracciamento, limiti di velocità e costi eccessivi di token
- Deployment: Docker, CI/CD e gestione dei segreti
Ricevi un rapporto con severità, con prove, mappato ai Top 10 OWASP LLM, più un piano di correzione prioritario. Nel pacchetto top, implemento le correzioni e rifaccio i test.
Piattaforme: LangGraph, LangChain, CrewAI, agent n8n e Python/FastAPI personalizzato, con modelli OpenAI, Claude o locali.
Scrivimi cosa fa il tuo agente e come è distribuito prima di ordinare.
Tecnologia di sviluppo:
Python

