Auditerò il tuo agente AI per injection di prompt e rischi di sicurezza


Level 1
Informazioni su questo servizio
Traduzione automatica.
Il tuo agente AI è sicuro da mettere davanti a utenti reali? La maggior parte degli agenti AI viene consegnata senza test di prompt injection, il che significa che chiunque può ingannare il tuo chatbot facendogli ignorare le istruzioni, rivelare il system prompt o eseguire azioni che non dovrebbe.
Eseguo una verifica completa di sicurezza dell'agente AI: tentativi di prompt injection, test di jailbreak, controlli di perdita di dati e scenari di abuso delle API o delle chiamate agli strumenti, usando le stesse tecniche che un utente malintenzionato proverebbe, ma documentate in modo che tu possa sistemarle prima che vengano sfruttate.
Ciò che copre:
- Audit di sicurezza LLM: perdita di prompt di sistema, override delle istruzioni, resistenza al jailbreak
- Test di prompt injection: injection diretta e indiretta tramite input utente, documenti o output degli strumenti
- Red teaming AI: test avversariali contro le chiamate agli strumenti e i permessi del tuo agente
- Test di vulnerabilità: chiavi API, accesso non sicuro agli strumenti e permessi eccessivi dell'agente
- Un rapporto scritto con la classifica delle vulnerabilità per gravità e raccomandazioni di correzione
Background: oltre 2 anni di esperienza in Python backend, ingegneria di LLM/GenAI, pipeline RAG e automazione AI in più di 30 progetti freelance.
Inviami l'accesso al tuo agente (o una versione sandbox/demo) e definirò l'ambito dell'audit prima di iniziare.
Scopri di più su Anchal
AI ML Developer: NLP Generative AI RAG and Automation Expert
Level 1
- DaIndia
- Membro dalug 2024
- Tempo di risposta medio1 ora
- Ultima consegna2 settimane
Lingue
Hindi, Inglese
Traduzione automatica.
Il mio portfolio
Altri servizi della categoria Sviluppo di software offerti da me
FAQ
Traduzione automatica.
Hai bisogno di accesso completo al mio sistema o posso fornirti una versione sandbox?
Una versione sandbox o demo va bene — non ho bisogno di accesso in produzione né dei tuoi dati utente reali per eseguire l'audit.
Cercherai davvero di sabotare il mio agente o semplicemente revisionerai il codice?
Entrambe le cose. Lo testerò come farebbe un attaccante (tentativi di prompt injection dal vivo) e rivedrò la configurazione di prompt e permessi sottostante, perché le vulnerabilità reali spesso si trovano in entrambi i posti.
Se trovi un problema critico, lo risolvi anche?
Le opzioni Basic e Standard coprono solo l'audit e il rapporto. Premium include l'implementazione di guardrail per risolvere i problemi trovati. Se emerge qualcosa di critico in Basic/Standard, lo segnalerò immediatamente invece di aspettare la consegna.
