Testerò il tuo chatbot o agente AI per l'injection di prompt


Informazioni su questo servizio
Traduzione automatica.
La maggior parte dei consigli sulla sicurezza dell'AI si ferma a "aggiungi un filtro". Ma questo non basta a fermare un attacco su un agente.
Un chatbot produce testo, quindi il peggior caso è un output sbagliato. Un agente compie azioni, quindi il peggior caso è un'azione sbagliata. Riporto ciò che il tuo sistema può essere indotto a FARE, non solo ciò che dice.
Ciò che testo:
- Iniezione diretta di prompt: sovrascrittura delle istruzioni, confusione di ruolo, estrazione del prompt di sistema
- Iniezione indiretta: istruzioni ostili nascoste in documenti o pagine che il tuo AI legge
- Abuso di tool e chiamate di funzione: può l'input far chiamare uno strumento che non dovrebbe?
- Perdita di dati: prompt di sistema, chiavi, contesto di altri utenti
- Superamento delle barriere di sicurezza: dove un filtro è una trappola, non un controllo
Ricevi un rapporto scritto: ogni scoperta confermata con passaggi di riproduzione, gravità e una soluzione specifica. Scritto per ingegneri, non un semplice dump di scanner.
Costruisco anche questi sistemi. Il mio pipeline open-source per agenti difende dall'injection a livello architetturale - la fase di estrazione non contiene strumenti di rete. Il mio scanner segreto utilizza 108 pattern in 805 test.
Crediti nel Google's Vulnerability Reward Program e da UNICEF.
Contattami prima di ordinare e ti dirò sinceramente se è in scope.
Scopri di più su Md. Azmol Haque
AI Safety Security Researcher
- DaBangladesh
- Membro dagen 2023
- Tempo di risposta medio17 ore
Lingue
Bengali, Inglese
Traduzione automatica.
Il mio portfolio
FAQ
Traduzione automatica.
romperai il mio chatbot o lo lascerai in uno stato brutto?
No. I test vengono eseguiti su account di test contro dati non di produzione, e non modifico il tuo sistema. Se un attacco riuscito attiva una chiamata a uno strumento, mi fermo lì e lo documenterò invece di ripeterlo.
E se niente funziona - riceverò comunque un report?
Sì, ed è un buon risultato per cui vale la pena pagare. Ricevi la matrice completa degli attacchi: tutte le famiglie testate, quanti prompt per ciascuna e cosa hanno catturato le tue difese. Sapere quali attacchi il sistema già resiste ti aiuta a capire dove non spendere di più.
Hai bisogno di accesso di produzione o dati clienti?
No. Basta un account di test o una chiave API contro un deployment di staging. Non testo mai contro dati reali di clienti o assistenti live che servono utenti reali.
Ho solo un chatbot semplice, non un agente. Ne vale la pena?
Sì, anche se il profilo di rischio è diverso. Senza strumenti collegati, le principali esposizioni sono divulgazione del system-prompt, bypass delle policy e danni reputazionali. Scrivimi cosa fa e ti dirò onestamente se Basic ti copre.
Puoi testare un prodotto AI che non possiedo?
No. Ho bisogno di un'autorizzazione scritta da chi ne è proprietario. Questa è una regola a cui non faccio eccezioni.
Come funziona il retest gratuito?
Consegnò prima il rapporto e l'ordine si completa con quello. Il retest è valido per 30 giorni dopo - scrivimi quando le correzioni sono attive e le verificherò, inviando un rapporto aggiornato. Non serve un nuovo servizio.

