Eseguirò jailbreak del modello AI, test di injection di prompt e analisi della sicurezza di llm

N
neonxploit
N
neonxploit
Manjeet

1 ordine in coda

Alcune informazioni sono state tradotte automaticamente.

Informazioni su questo servizio

Traduzione automatica.

Effettuerò una valutazione completa della sicurezza del modello AI, inclusi test di jailbreak, analisi di injection di prompt, tentativi di bypass dei filtri di sicurezza e rilevamento di vulnerabilità per LLM e chatbot.

Sono specializzato nell’individuare punti deboli nei sistemi di AI e nel mostrare come gli attaccanti possano manipolare il tuo modello per generare risposte non sicure, dannose, di parte o non autorizzate.


COSA TESTERÒ

1. Attacchi di jailbreak

  • Jailbreak in stile DAN
  • Override del prompt di sistema
  • Attacchi di cambio personalità
  • Fuga dal ruolo e attivazione forzata della modalità interna

2. Attacchi di injection di prompt

  • Manipolazione diretta del prompt
  • Injection indiretta di prompt (istruzioni nascoste)
  • Injection di prompt HTML/Markdown
  • Attacchi di avvelenamento del contesto

3. Bypass dei filtri di sicurezza

  • Superare le barriere di sicurezza
  • Far uscire il modello contenuti limitati
  • Superare i limiti etici
  • Conflitti nascosti nelle policy

4. Attacchi avversariali multi-step

  • Manipolazione della catena di pensiero
  • Attacchi contestuali a più livelli
  • Loop di istruzioni ricorsive

5. Test di allucinazioni e bias

  • Condizioni scatenanti per allucinazioni
  • Controlli di amplificazione dei bias
  • Risposte contraddittorie
  • <li Trappole di ragionamento errato

Scopri di più su Manjeet

Manjeet
  • DaIndia
  • Membro daapr 2025
  • Tempo di risposta medio1 ora
  • Ultima consegna1 mese
  • Lingue

    Inglese
I am an AI Safety Tester and Cybersecurity Researcher with expertise in identifying vulnerabilities in AI models, LLMs, and web systems. I specialize in: AI jailbreak detection Prompt injection testing LLM safety evaluation Security auditing for chatbots Penetration testing basics Python-based security automation I have submitted 36+ AI vulnerability reports and received 20+ acknowledgments from OpenAI for ethical research. If you need someone to test your AI model, secure your chatbot, or evaluate your system for vulnerabilities — I can help with professional reporting and fast

Traduzione automatica.