Farò red team al tuo agente LLM per prompt injection e attacchi alla memoria

S
sidharth1
S
sidharth1
Sidharth P
Alcune informazioni sono state tradotte automaticamente.

Informazioni su questo servizio

Traduzione automatica.

Il tuo agente LLM è sicuro da mettere davanti a utenti reali? Lo attaccherò come farebbe un vero adversary e ti dirò esattamente cosa si rompe e come sistemarlo.


Sono un ricercatore sulla sicurezza dell'AI con pubblicazioni a ICML e IJCNLP e lavori su arXiv riguardo attacchi alla memoria contro agenti LLM. Ho anche creato benchmark di valutazione LLM-judge, quindi i miei test sono sistematici e riproducibili, non solo una manciata di prompt intelligenti.


Cosa testo:

  • Prompt injection (diretta e tramite documenti, pagine web o output di strumenti)
  • Jailbreak e bypass delle policy
  • Uso improprio di strumenti e chiamate di funzione
  • Inquinamento della memoria e del contesto in agenti con memoria a lungo termine
  • Fuga di prompt di sistema e dati


Cosa ottieni:

Un rapporto scritto chiaro con ogni scoperta, un esempio riproducibile, una valutazione di gravità e una soluzione concreta. I pacchetti più avanzati includono la suite di attacco come codice così puoi rifarla, più un retest dopo aver applicato le patch.


Compatibile con OpenAI, Anthropic, modelli open-source, LangChain, LlamaIndex e stack di agenti personalizzati. Scrivimi prima con una breve descrizione del tuo agente e confermerò il campo di applicazione. Testo solo sistemi di cui sei proprietario o autorizzato a testare.

Scopri di più su Sidharth P

Sidharth P

AI Safety Researcher and LLM Fine Tuning Expert

  • DaIndia
  • Membro daapr 2017
  • Lingue

    Telugu, Inglese, Hindi
AI researcher in LLM safety and NLP. Research Intern at AI4Bharat (first author of IndicBERT-v3, open multilingual encoder LLMs) and Research Fellow at SPAR. Papers at ICML 2026 and IJCNLP-AACL 2025, plus arXiv work on memory attacks against LLM agents. Hands-on with LoRA/QLoRA and full fine-tuning (SFT, GRPO), multi-GPU training on H100s, vLLM/SGLang inference and LLM-as-judge evaluation. I help teams fine-tune open-source LLMs, build evaluation pipelines, red-team LLM agents and reproduce ML papers. Message me your goal and I will reply with a clear plan.

Traduzione automatica.

Il mio portfolio

Altri servizi della categoria Sviluppo AI offerti da me

Tag correlati