OCR layout-aware
Estrae testo da contratti scansionati, atti, allegati e tabelle, mantenendo intatta la struttura del documento.
Tecnologia
Zaphir costruisce un modello operativo di parti, contratti, clausole, obblighi, controlli ed evidenze. Ogni risposta è ancorata ai documenti con citazione puntuale. Niente generazione opaca, niente fonti inventate.
VISIONE D'INSIEME
Zaphir si collega ai sistemi sorgente, riconosce parti, contratti, clausole, obblighi, policy, controlli ed evidenze e restituisce risposte con citazioni puntuali.

COME FUNZIONA
Riconoscimento delle entità, mappa delle relazioni, citazioni puntuali, generation grounded. Quattro pezzi che lavorano insieme, perché ogni numero e ogni clausola siano verificabili alla fonte.
01 · ENTITÀ
La stessa controparte può apparire con ragione sociale, nome breve o identificativo. Zaphir riconosce che si tratta dello stesso soggetto e lo collega a contratti, obblighi, comunicazioni e fascicoli in un unico grafo operativo.

02 · RELAZIONI
Una parte è collegata ai contratti, le clausole agli obblighi, gli obblighi ai controlli e i controlli alle evidenze. Una rete viva di relazioni, non un archivio piatto. Le query attraversano questa rete e mantengono ogni passaggio verificabile.

03 · CITAZIONE
Niente generazione opaca. Ogni clausola, obbligo e finding è ancorato a un passaggio specifico: nome file, pagina e paragrafo. Se la fonte non esiste, l'affermazione non viene generata.

04 · RAG
Quando arriva una domanda, Zaphir attiva ricerca semantica e full-text su contratti, policy, normativa e fascicoli. Il reranking contestuale seleziona i passaggi più rilevanti, che diventano contesto per una risposta con citazioni automatiche.

CAPABILITIES
Sono i pezzi che rendono operativo il modello legal e compliance. Lavorano in pipeline, ognuno alimenta il successivo.
Estrae testo da contratti scansionati, atti, allegati e tabelle, mantenendo intatta la struttura del documento.
Rappresentazioni vettoriali del corpus legale in italiano, inglese, francese, tedesco e spagnolo. Domande e documenti possono usare lingue diverse.
Riordina i risultati di ricerca per rilevanza al contesto specifico della domanda d'analisi. Un modello dedicato che pesa le sfumature, non un punteggio statico.
Riconosce parti, ruoli, autorità, clausole, obblighi, importi e date e li collega all'entità giusta nel grafo.
Numeri che descrivono il funzionamento e la tracciabilità sui carichi documentali reali.
Milioni
di pagine di contratti, policy e fascicoli indicizzabili in un unico modello operativo
Ogni
risposta cita documento, pagina e paragrafo
5
lingue gestite nativamente nella ricerca semantica
100%
delle elaborazioni in data center UE
SICUREZZA
Per legal e compliance la sicurezza non è una lista di feature: è un insieme di scelte architetturali non negoziabili.
L'intera elaborazione avviene in data center UE. Nessun trasferimento extra-UE, nessuna esposizione a giurisdizioni terze. Disponibile anche in deployment on-premise.
Contratti, policy, fascicoli e corrispondenza non vengono mai usati per addestrare modelli. Zero retention.
Crittografia a riposo e in transito su tutto il flusso. Le chiavi restano gestite secondo le best practice europee.
Privacy by design, diritto all'oblio nativo, DPA disponibile. La conformità è una proprietà del sistema, non una policy a posteriori.
Ogni operazione è loggata: query, accessi, esportazioni. Log immutabili, esportabili nei tuoi SIEM, pronti per i controlli di compliance e i regulator.
Integrazione SSO e segregazione per ruolo, società e matter. Ogni professionista vede solo i documenti autorizzati, con ethical wall e information barrier rispettate.
Il nostro team può organizzare un deep-dive sull'architettura e un proof of concept su un corpus legal o compliance reale.