26/08/2026
TuaGPT® e TuaGate®
AI on-premise, RAG locale & privacy by design
Piattaforma di intelligenza artificiale 100% on-premise per aziende, professionisti e PA che vogliono utilizzare modelli LLM in LAN senza inviare documenti sensibili o prompt a server cloud esterni: client desktop TuaGPT® su Windows per chat e RAG locale, e gateway TuaGate® per orchestrare più motori con API compatibili OpenAI, streaming SSE, cache e audit trail — progettata per garantire totale sovranità dei dati e conformità a GDPR, EU AI Act e Direttiva NIS2.
AI locale in azienda,
pronta per la produzione
Progetto TuaGPT®
Contatta per demo o preventivo
inferenza locale su GPU/CPU aziendali, latenza azzerata in LAN e audit trail per la conformità normativa.
Stack e motori compatibili:
Ollama · LM Studio · vLLM · endpoint OpenAI-like
TuaGPT® Client
e TuaGate® Gateway AI
Due applicazioni native complementari: il Client desktop per l'utente finale su Windows (chat, RAG, embeddings ONNX, estensione browser, tool) e il Gateway per il reparto IT (routing multi-backend, failover automatico, streaming SSE, caching e governance centralizzata).
Client Windows
Gateway API & Reverse Proxy
/v1/chat/completions, /v1/embeddings e /v1/models verso più motori LLM (Ollama, LM Studio, vLLM) con priorità e failover automatico. Streaming SSE a bassa latenza e caching intelligente (LRU/LFU/FIFO con TTL) per abbattere drasticamente tempi di risposta e carico computazionale.& Conformità (GDPR, AI Act, NIS2)
& PoC in 5 Giorni
Scenari applicativi in azienda
Implementazioni reali dell'AI on-premise. Approfondimenti: case study on-premise e risorse per aziende.
alla prima chat
Gateway che scala con l'azienda
Fallback trasparente tra server LLM, cache configurabile ed emissione in streaming SSE: meno punti fragili e tempi di risposta stabili per tutte le postazioni collegate.
Qualità ottimizzata lato server
Power Sampling e Self-Consistency migliorano la coerenza delle risposte complesse; combinati con la cache ad alta efficienza riducono il carico ripetuto sui nodi di calcolo.
Sicurezza operativa certificabile
HTTPS gestibile da interfaccia, hash password BCrypt, token con scadenza, licenze con feature flag e audit log completo delle richieste: conformità immediata e verificabile. Trust Center · Checklist RFP
Integrazione TuaGPT + TuaGate
Il client assicura un'esperienza d'uso fluida con RAG ed export; il gateway centralizza API e criteri di sicurezza. Stesso contratto OpenAI-like per integrare qualsiasi strumento compatibile nella tua LAN.
TuaGPT: chat & tool desktop
Conversazioni organizzate ed effimere, conteggio token, streaming SSE, tool integrati per ricerca web reale con estensione browser, filesystem e posta Thunderbird.
RAG locale & ONNX sul PC
Indicizzazione documentale su PDF, Office e immagini con OCR, embeddings ONNX generati in locale su SQLite, ricerca semantica rapida e crittografia database opzionale.
Output professionale ed export
Supporto per Markdown, formule matematiche LaTeX, temi scuro/chiaro, font personalizzabili ed export diretto in PDF, Word (DOCX), ODT e JSON per archiviare e condividere i risultati.
TuaGate: API OpenAI unificate
Endpoint standard /v1/chat/completions, /v1/models ed /v1/embeddings con path alias multipli; catalogo modelli aggregato da tutti i server attivi in LAN.
Prestazioni, cache & resilienza
Streaming SSE, bilanciamento con priorità e failover automatico tra nodi LLM, cache configurabile (LRU/LFU/FIFO) con TTL, Power Sampling e Self-Consistency lato server.
Multi-utente & RAG federato
Gestione utenti centralizzata con token Bearer JWT, HTTPS, audit log delle richieste e registry RAG distribuito con callback verso i client per condividere snippet senza esporre i vettori.
sistema
misurabile,
sotto controllo
per ogni dimensione aziendale
richiedi quote e demo personalizzata.
Ultime dal Blog — AI On-Premise & Privacy
Articoli tecnici, casi studio e guide pratiche su RAG on-premise, gateway API in LAN, sovranità dei dati e intelligenza artificiale per le aziende.
13/08/2026
Chatbot TUA: conosce tutto il catalogo del tuo e-commerce
10/08/2026
DLP in TuaGate: proteggere i dati sensibili prima che raggiungano l'AI
Domande frequenti su
LLM locale e TuaGPT
TuaGPT è la piattaforma AI on-premise che consente un approccio rapido all'intelligenza artificiale senza compromessi. L'installazione dell'intero ecosistema client-server è fattibile in poche decine di minuti e non necessita di configurazioni particolari. La usi subito senza dover apprendere concetti o procedure complessi.
No. TuaGPT è il client che dialoga con questi backend tramite API compatibili OpenAI. Il modello resta sul motore che scegli (Ollama, LM Studio, cloud, ecc.).
Sì: l'indicizzazione avviene nel database locale dell'applicazione. In modalità condivisione con TuaGate non vengono caricati i vettori sul gateway: circolano solo metadati e risultati di ricerca pertinenti.
TuaGate è il server gateway (API, amministrazione, multi-backend, sharing). TuaGPT è il client desktop per chat, RAG, ONNX, estensioni e export. L'interfaccia chat per l'utente finale è su TuaGPT.
No per chat con modelli locali e per molte funzioni ONNX. Sì se usi API cloud, aggiornamenti, alcuni scenari con TuaGate o la ricerca web. L'inferenza in LAN riduce la dipendenza dalla connessione esterna.
L'architettura on-premise di TuaGPT e TuaGate è progettata per supportare obblighi GDPR e AI Act: crittografia TLS, token a scadenza, inferenza in LAN e controllo sui flussi dati. Dettagli: Sicurezza & Conformità. Per una valutazione strutturata: checklist RFP.
Con TuaGPT i prompt e i documenti RAG restano in rete aziendale o sul PC utente. Le soluzioni cloud inviano i dati a fornitori esterni: TuaGPT offre la stessa esperienza di chat con sovranità del dato e gateway controllato.
Sì. TuaGate instrada le richieste verso più backend configurati con priorità e fallback automatico, da un unico endpoint OpenAI-compatibile /v1/chat/completions.