Costruirò chatbot AI usando llm, rag e database vettoriale

J
jiuban1
J
jiuban1
zhumingming
Alcune informazioni sono state tradotte automaticamente.

Informazioni su questo servizio

Traduzione automatica.

Ciao! Sono uno sviluppatore full-stack specializzato in chatbot AI e integrazione di LLM, con oltre 3 anni di esperienza.


Ho creato la mia piattaforma di machine learning (njmaet) e distribuito modelli MoE da 35B di parametri su server con 8-GPU per clienti aziendali. Conosco i sistemi di AI dall'inizio alla fine: dalla scelta del modello alla distribuzione in produzione.

COSA COSTRUISCO PER TE:


1. chatbot AI GPT, Claude o modelli open-source (Llama, Qwen, DeepSeek) integrati nel tuo sito o app

2. chatbot RAG un chatbot che risponde dai TUOI documenti (PDF, sito web, database) usando la ricerca vettoriale (Milvus, Faiss)

3. assistenti AI personalizzati perfezionati sui tuoi dati, parlando con la voce del tuo brand


PERCHÉ LAVORARE CON ME:


- Esperienza reale in produzione: distribuisco LLM (7B-70B) su server GPU usando vLLM e Ollama

- Full-stack: il tuo chatbot avrà un'interfaccia web pulita (Node.js + React), non solo uno script

- Gestisco API, database, distribuzione e documentazione

- Comunicazione chiara, consegna puntuale


<p COME FUNZIONA:

1. Mandami un messaggio descrivendo il tuo progetto

2. Rispondo con un piano, una timeline e il pacchetto più adatto a te

3. Ricevi aggiornamenti sul progresso fino alla consegna


Hai domande? Messaggia

Scopri di più su zhumingming

zhumingming

Full Stack Developer and AI LLM Deployment Specialist

  • DaCina
  • Membro daott 2026
  • Tempo di risposta medio1 ora
  • Lingue

    Cinese, Inglese
Full-stack developer, 3+ years in web dev and AI/ML deployment. • Full-Stack: Node.js + React, PostgreSQL/MongoDB, APIs, dashboards • AI Deployment: LLMs (7B-70B) on GPU servers via vLLM, Ollama • Fine-tuning: QLoRA/LoRA on custom datasets • AI Integration: RAG, vector DBs (Milvus/Faiss), chatbots, MCP connectors Built a dedicated ML platform (njmaet) from scratch, and deployed 35B MoE models on 8-GPU servers for enterprise clients. From training to production — I handle it all. Reliable, on time. Let's discuss your project!

Traduzione automatica.