Deployo AI privata self-hosted sul tuo server con ollama e open webui


Informazioni su questo servizio
Traduzione automatica.
Il tuo team desidera un AI stile ChatGPT. La tua policy di conformità dice che i dati del cliente non possono lasciare il tuo controllo. Questo servizio risolve entrambi i problemi.
Deployo una stack di AI privata - Ollama + Open WebUI - sul tuo server o VPS. Prompt, cronologia chat e documenti non toccano mai un cloud di terze parti. Pensato per legale, medico e qualsiasi attività con una policy no-cloud-AI.
Ogni livello include:
- Deployment Docker in produzione con reverse proxy HTTPS
- 2-3 modelli aperti scelti e ottimizzati per il tuo hardware
- Guida amministratore scritta: aggiornamenti, backup, gestione utenti
- Tu possiedi tutto: configurazioni, codice, credenziali di amministrazione
- Comunicazione diretta con base negli Stati Uniti
La versione standard include RAG - le risposte del tuo AI dai tuoi documenti - più accesso remoto sicuro Tailscale per il tuo team. La versione premium aggiunge un endpoint API compatibile con OpenAI per il tuo software, account utente, una call di consegna e 14 giorni di supporto.
Su di me: laurea in Ingegneria Elettrica, dieci anni nel settore dei semiconduttori. Gestisco questa stack in produzione 24/7 su infrastruttura che ho costruito e mantenuto - LLM self-hosted, servizi Docker, rete VPN mesh, logging SIEM.
Non sono l'offerta più economica qui. Sono quello che documenta il lavoro e ti consegna le chiavi.
Scopri di più su Michael B
AI Automation Engineer, Private LLMs, Alerting, Network Security
- DaStati Uniti
- Membro dagen 2026
- Tempo di risposta medio1 ora
Lingue
Inglese
Traduzione automatica.
Altri servizi della categoria Sviluppo AI offerti da me
FAQ
Traduzione automatica.
Perché dovremmo fidarci di te con l'accesso amministrativo durante l'installazione?
Posso lavorare tramite condivisione schermo così puoi vedere ogni passo. Fornisci credenziali temporanee e le ruoti al momento della consegna; le documentazioni mostrano esattamente cosa gira dove. Tutto il software è open source e niente comunica con me. NDA su richiesta - e posso mostrarti una demo della mia istanza live prima di ordinare.
Ci sono costi ricorrenti per API o licenze dopo la consegna?
No. Ollama, Open WebUI e LiteLLM sono open source, e i modelli girano sul tuo hardware. Non ci sono costi per token né abbonamenti - l'unico costo ricorrente è il server stesso (energia o affitto VPS).
Cosa devo fornire?
Un server Linux o VPS (posso consigliarne uno adatto al tuo budget), un modo per darmi accesso (chiave SSH o credenziali temporanee), e un dominio se vuoi HTTPS su un indirizzo pubblico. Per RAG Standard/Premium, i documenti che vuoi che l'AI conosca.
Quale hardware serve?
Open WebUI funziona quasi ovunque; la velocità del modello dipende da RAM e GPU. Un CPU moderno con 16 GB di RAM gestisce bene modelli piccoli; una GPU rende veloci modelli più grandi. Mandami le tue specifiche (o budget) prima di ordinare e ti dirò onestamente quale performance aspettarti.
Cosa succede dopo il parto?
Ogni livello include una guida scritta per l'amministratore che copre aggiornamenti, backup e gestione utenti. La versione premium include una call di consegna dal vivo e 14 giorni di supporto. Manutenzione continua o upgrade successivi - nuovi modelli, più utenti, integrazioni API - sono disponibili come offerte personalizzate.
Sarà efficace come ChatGPT?
Per stesura, riassunto e Q&A sui tuoi documenti, i modelli aperti attuali (Llama, Qwen, Mistral) fanno un ottimo lavoro. I modelli cloud di Frontier sono ancora più forti nel ragionamento complesso - il compromesso che acquisti è la totale privacy dei dati. Abbino i modelli al tuo caso d'uso onestamente.
