Riparerò, valuterò e ottimizzerò la tua app rag o llm per precisione e costi

P
pulkit004
P
pulkit004
Pulkit V.
Alcune informazioni sono state tradotte automaticamente.

Informazioni su questo servizio

Traduzione automatica.

La tua app AI funziona nella demo ma si blocca con utenti reali: risposte sbagliate, allucinazioni, risposte lente, bollette API sorprendenti. Scoprirò perché e la sistemerò.


Correzioni comuni:

  • Recupero sbagliato: chunking, embeddings, ricerca ibrida, reranking
  • Allucinazioni: grounding, citazioni, comportamento di rifiuto
  • Bug nei prompt e nell'output strutturato (JSON che si rompe)
  • Latenza: streaming, caching, modelli più piccoli dove sono sufficienti
  • Costo: budget token, routing del modello, caching dei prompt
  • Nessuna valutazione: preparo un set di test così puoi misurare la qualità invece di indovinare


Funziona con LangChain, LlamaIndex, SDK OpenAI/Claude raw, SDK Vercel AI, AWS Bedrock e n8n.


Perché me: Come Engineering Manager che guida iniziative AI, ho consegnato pipeline RAG in produzione e agenti di revisione AI, e mi interessa anche la parte meno glamour: valutazioni, casi di fallimento e costi per richiesta.


Scrivimi con il tuo stack e 3-5 esempi di output sbagliati.

Scopri di più su Pulkit V.

Pulkit V.

Engineering Manager building production RAG and AI agents

  • DaIndia
  • Membro dagiu 2017
  • Lingue

    Hindi, Inglese
I build AI systems that ship, not demos. Engineering Manager at Setu (Pine Labs), leading AI initiatives: production RAG pipelines, AI agents in engineering workflows, and LLM-powered insights. 8+ years building products as an engineer and tech lead. Founder of WeaveAI, an AI engineering studio. M.S. Data Science at the University of Pittsburgh. I deliver: RAG with citations, n8n automations and AI agents, Claude Code setups for dev teams, and fixes for LLM apps that hallucinate, lag, or cost too much. Evals included. Message me before ordering so we can scope it right.

Traduzione automatica.

Il mio portfolio