Edizioni

Community per il team open. Pro per la scala produttiva.

Lo stesso motore, in due pacchetti molto diversi. Community è AGPL-3.0 e si distribuisce come singolo binario da lanciare. Pro aggiunge un data warehouse strutturato, retrieval ibrido, uno scheduler intelligente e un admin panel — per i team che devono interrogare migliaia di documenti come dati, non solo come testo.

Community

AGPL-3.0 · open-source

RAG sovrana, a un binario di distanza.

  • Un solo binario — avvia da sé vector store e motore di inferenza
  • Retrieval vettoriale su oltre 100 lingue, calcolato nel processo
  • Backup giornaliero coerente e ripristino sull'installazione in esecuzione
  • GPU NVIDIA usata in automatico quando c'è, altrimenti CPU
  • Dopo il primo avvio non serve più alcuna connessione
Vai su GitHub

Pro

Licenza commerciale

Più potente

Production-grade per carichi regolamentati.

  • Inference engine EuLLM custom (sovrano di default)
  • Retrieval ibrido: vector + BM25 + cross-encoder rerank
  • Estrazione LLM verso un warehouse SQL
  • Scheduler intelligente con coordinamento live
  • Backup schedulato verso storage fuori dalla macchina
  • Admin panel + modalità completamente air-gapped
Parla con noi

Fondamenta condivise

Entrambe le edizioni girano interamente dentro il tuo perimetro. Niente chiamate in uscita, niente telemetria, niente dipendenze gestite.

  • Autenticazione JWT con tre ruoli, applicati a livello di retrieval
  • Una web UI e un'API REST sopra lo stesso motore
  • Vector store Qdrant (open-source, sviluppato a Berlino)
  • Inferenza LLM locale — il modello gira sul tuo hardware
  • OCR Tesseract, così anche le pagine scansionate diventano interrogabili
  • PDF, DOCX, XLSX, HTML, TXT, Markdown e CSV
  • Porte di default diverse — le due edizioni possono coesistere sullo stesso host

Cosa aggiunge Pro

Sette capability concrete che l'edizione Community open non include.

01

Inference engine EuLLM custom

Pro integra EuLLM come backend di generazione di default: uno stack di inferenza LLM sovrano europeo costruito attorno a pesi GGUF, con continuous batching e finestra di contesto da 16K token. Ollama resta disponibile come profilo di fallback per la valutazione.

  • Continuous batching per throughput elevato su host single-GPU
  • Context window da 16K token per contratti lunghi, trascrizioni e report
  • Completamente air-gapped: modalità HuggingFace offline, nessuna chiamata casa
  • Compatibile con Mistral 7B (made in France) e altri modelli GGUF
02

Retrieval ibrido

La pure vector search manca i match keyword precisi; il puro BM25 manca la semantica. Pro li esegue entrambi, li fonde con Reciprocal Rank Fusion e riordina il risultato con un cross-encoder.

  • Vector + BM25 con bilanciamento lessicale-semantico configurabile
  • Cross-encoder reranking per precisione sui top-K
  • Multi-query expansion per domande ambigue
  • Analytics di query su ogni step della pipeline
03

Warehouse di dati strutturati

Esclusiva Pro

Pro non si limita a indicizzare i documenti — estrae entità, eventi e importi in un database relazionale normalizzato. Quel database diventa una sorgente di fatti verificati che la pipeline di chat può citare con provenance.

  • Schema a sei tabelle: extraction jobs, entities, events, amounts, progress, document summaries
  • Colonne indicizzate e foreign key — le query analitiche sono veloci
  • SQLite con WAL oggi; portabile a PostgreSQL quando serve scalare
  • Quattro profili di dominio: Generic, Intelligence/OSINT, Medical, Legal
  • Validazione Pydantic con recovery automatico per JSON LLM malformati
  • Ogni fatto estratto è linkato al chunk sorgente per audit
Risultato: domande come "quanti contratti citano il fornitore X", "elenca tutti gli eventi del Q3 2025" o "esposizione totale per controparte" si rispondono da SQL, non tirando a indovinare dalla similarità vettoriale.
04

Query router

Un piccolo classifier decide a runtime se la domanda è aggregate, semantica o ibrida — poi la indirizza al backend giusto e compone la risposta.

  • Domande aggregate (count, elenca, group-by, filtri per data) → warehouse SQL
  • Domande semantiche ("perché", "come", "spiega") → vector retrieval
  • Domande ibride ricevono entrambi: i fatti SQL iniettati nel prompt LLM come "dati verificati", i chunk recuperati come contesto
  • Deterministico, trasparente, ispezionabile per ogni richiesta
05

Scheduler intelligente con coordinamento live

L'estrazione è un job pesante. Pro la coordina con le persone che stanno effettivamente usando il sistema, invece di rompere l'esperienza di chat.

  • Orario di esecuzione configurabile (default 20:00); polling ogni 60 secondi
  • Gli utenti connessi ricevono una notifica WebSocket prima dell'avvio
  • Conferma adesso, oppure rinvia — fino a 3 volte, 15 minuti l'una
  • Switch dinamico del modello durante l'estrazione: la chat passa da 14B a 8B per liberare VRAM, poi torna su
  • Checkpoint per documento: si riprende senza ripartire da zero
06

Ingestion hands-free + admin panel

Lasci un file in una cartella sorvegliata e finisce sia nell'indice vettoriale sia in coda di estrazione. L'admin panel dà agli operatori un'unica console.

  • Folder watcher per ingestion batch — niente step di upload manuale
  • Pipeline OCR estesa per moduli compilati a mano, scansioni multi-colonna e fax di qualità bassa
  • Resource monitoring (CPU, memoria, GPU) integrato in UI
  • Service control: riavvia i componenti dall'admin panel
  • Dashboard dei job di estrazione con stato, errori e rerun manuale
  • UI di configurazione per scheduler, retention e selezione modello
07

Backup che esce dalla macchina

Esclusiva Pro

Community tiene un archivio giornaliero coerente — database applicativo e snapshot vettoriale presi insieme — ma lo tiene come file locale, sullo stesso host della cosa che sta proteggendo. È un buon backup e una pessima strategia di disaster recovery. Pro lo manda altrove, su base schedulata, con una politica di retention.

  • Copie schedulate verso lo storage che già usi: object storage S3-compatibile, WebDAV / Nextcloud, SFTP, FTP, Backblaze B2
  • Politiche di retention, così gli archivi vecchi scadono da soli invece di riempire il volume
  • Restore selettivo — recuperi database, indice vettoriale o documenti sorgente in modo indipendente
  • Le credenziali della destinazione vengono conservate offuscate, mai in chiaro
  • Gli endpoint di backup e restore sono riservati agli amministratori, con protezione da path traversal in fase di estrazione
  • Il database viene copiato a caldo: nessun fermo servizio e nessuno snapshot scritto a metà
Il punto è semplice: un backup sulla stessa macchina non sopravvive al guasto di quella macchina. Scegliere una destinazione residente in UE lascia intatto il discorso sulla sovranità mentre la copia esce dall'edificio.

Community copre l'80% dei casi

Quasi nessun team ha bisogno di un warehouse di estrazione — e per quelli, Community è la scelta giusta.

  • Best fit: reparti e installazioni su singolo host, dove il lavoro è trovare risposte dentro i propri documenti
  • Killer feature: è un solo binario. Niente Docker, niente Compose, niente da orchestrare, e nessuna rete dopo il primo avvio
  • AGPL-3.0 significa che puoi auditarlo, modificarlo ed embeddarlo nel tuo lavoro AGPL-compatibile
  • Nessun contratto commerciale, nessuna dipendenza dal vendor — è forkabile il giorno in cui smettiamo di mantenerlo

Quando scegliere Pro

Se anche solo una di queste condizioni è vera, l'edizione Pro si ripaga in fretta.

  • Hai bisogno di query aggregate su migliaia di documenti (count, elenca, group-by, filtro per data)
  • La compliance richiede output strutturati deterministici (KYC, reporting regolatorio, audit trail)
  • Operi in un settore regolamentato — legale, sanità, intelligence/OSINT, difesa — e ti serve un profilo di estrazione tarato sul dominio
  • Ti serve operatività completamente air-gapped, modelli e metadata offline inclusi
  • La tua policy di disaster recovery richiede backup conservati fuori dalla macchina che li produce
  • Hai già Community in produzione e vuoi affiancarci Pro sugli stessi host durante la valutazione

Progettate per coesistere

Pro e Community usano porte di default diverse, così puoi farle girare entrambe sullo stesso hardware durante la valutazione o la migrazione.

ComponenteCommunityPro
Web UI:8000:3002
API:8000:8001
Qdrant:6333:6334
Motore LLMgestito dal binario:11435

Community serve la UI e l'API sulla stessa porta, e gestisce da sé il vector store e il motore di inferenza. In ogni caso i formati dati sono gli stessi: passare da Community a Pro è un cambio di configurazione e una license key, non una re‑ingestion.

Parti da dove sei. Fai l'upgrade quando serve.

L'edizione Community è su GitHub oggi. Per Pro, prenota una call da 30 minuti e ti torniamo con una proposta di deployment in due giorni lavorativi.

Pronto a far girare RAG sulla tua infrastruttura?

Parti dall'edizione Community open-source, oppure parla con noi di Pro con estrazione strutturata, SSO, audit log e SLA.

Community o Pro: quale edizione scegliere — I3K RAG Enterprise