Funzionalità della piattaforma

L'intero ciclo documentale, in un'unica piattaforma.

Dalla scansione alla pubblicazione: Captika cattura da qualsiasi fonte, estrae e valida i dati con OCR e IA, riconosce il tipo di documento e pubblica il risultato dove serve. Con regole, scripting .NET e tracciabilità end-to-end.

01
📥
Cattura
Scanner, e-mail, cartelle, FTP, SharePoint, Thuban
02
🏷️
Metadati
Campi per lotto, documento e pagina, con validazione
03
🔍
OCR e IA
Tesseract, Textract, Google Vision e OpenAI
04
🧠
Riconoscimento
Template dinamici e regole di estrazione
05
🚀
Pubblicazione
SQL, SharePoint, S3, Thuban, FTP e FileSystem
01 · Cattura

Cattura da qualsiasi fonte

Collega Captika ai canali che già usi e automatizza l'ingresso dei documenti senza cambiare il tuo modo di lavorare. Un unico flusso, tante porte d'ingresso.

  • Scanner fisici TWAIN con scansione in tempo reale e controllo qualità dell'immagine.
  • E-mail Office 365: elabora gli allegati direttamente dalle caselle aziendali nel cloud.
  • File System locale o di rete con cartelle e sottocartelle, controllo dei file in uso e rinomina automatica.
  • Server FTP / SFTP, ideali per automatizzare ambienti distribuiti.
  • SharePoint tramite ricerche ViewXML e Thuban da vassoi di lavoro, query e Stored Procedure.

Fonti di cattura

Escáner TWAIN Office 365 Cartelle / HotFolders FTP / SFTP SharePoint Thuban

Configura una o più fonti per lavoro di cattura e lasciale girare automaticamente.

Motore di scripting

.NET 10 C# VB.NET WebServices / APIs

Personalizza ogni evento del processo e collegati a qualsiasi sistema esterno. Possibilità di integrazione praticamente illimitate.

02 · Metadati e validazioni

Dati corretti fin dall'origine

Definisci i metadati con la massima flessibilità e valida le informazioni con i tuoi sistemi prima di pubblicarle. Meno errori, meno rilavorazioni.

  • Tre livelli di campi: per lotto, per documento e per pagina.
  • Liste a discesa intelligenti generate da database (SQL dinamico), Thuban o liste di SharePoint.
  • Validazione e arricchimento automatici con query SQL, rivalidazione con Thuban o scripting su misura.
  • Motore di scripting .NET 10 (C# / VB.NET) per regole e chiamate a WebServices o API in tempo reale.
03 · OCR e Intelligenza Artificiale

OCR e IA di primo livello

Estrai le informazioni chiave da qualsiasi documento con i motori OCR più potenti sul mercato e scegli il migliore per ogni tipo di documento.

🔤

Tesseract 5x (nativo)

OCR locale con cattura spaziale di ogni parola e riga, evitando letture ridondanti e consentendo la validazione visiva a schermo.

☁️

Amazon Textract

OCR nel cloud di testo stampato e manoscritto, con lettura di tabelle, moduli, firme, volti ed etichette nelle immagini.

👁️

Google Vision AI

Riconoscimento via API integrato in modo nativo, per aggiungere al tuo flusso un altro grande motore del mercato.

🤖

OpenAI / Bedrock

Esegui prompt intelligenti sui testi estratti per migliorare l'estrazione e il riconoscimento dei dati.

📄

PDF con livello di testo

Con PDFBox e PDFIUM: separa le pagine, rileva le firme e sfrutta il livello di testo originale per più velocità e qualità.

Codici a barre

Lettura 1D, 2D e PatchCodes: CODE128, CODE39, DATAMATRIX, PDF417, EAN13, QR e altro, per separare e classificare automaticamente.

04 · Riconoscimento intelligente

Template dinamici per qualsiasi documento

Captika riconosce sia documenti strutturati (fatture, moduli fiscali, pagherò) sia non strutturati (verbali, bilanci, lettere, contratti), con regole di estrazione per ogni campo.

  • Identifica i documenti per codice a barre, campi estratti, ordine di pagina, dimensione, peso o forma (image fingerprint).
  • Similarità testuale: carica un'immagine di esempio e imposta il livello minimo di similarità per riconoscere i documenti futuri.
  • Sacche di parole per sezione del documento, per accelerare notevolmente la creazione dei template.
  • Regole di pulizia NLP: date, e-mail, numeri scritti, codici fiscali (CUIT / CUIL / RUT), maschere dati e altro.

IA applicata (Amazon + OpenAI)

Comprehend — entità, frasi chiave e sentiment
Comprehend Classification — classifica per apprendimento (ML)
Rekognition — riconosce oggetti nelle immagini
OpenAI — prompt sul testo estratto

Combinando questi strumenti, il tuo circuito di cattura impara e migliora nel tempo.

05 · Pubblicazione

Pubblica su più destinazioni, in parallelo

Genera PDF o TIF multipagina —con livello di testo creato al momento della cattura— e pubblica documenti e metadati simultaneamente su più sistemi, ciascuno con la propria configurazione.

📁

FileSystem

Strutture di cartelle dinamiche in base ai campi riconosciuti, con nomi file configurabili e file di testo parametrizzabili.

🗃️

Database SQL

Pubblica tutti i dati catturati per l'utilizzo in sistemi analitici, gestionali o di back-office.

🔒

FTP / SFTP

Trasferimento sicuro di documenti e dati, con nomi e metadati esportati completamente configurabili.

🌐

Portale Thuban

Indicizzazione diretta: caricamento di nuovi documenti o aggiornamento di record esistenti.

🧩

Microsoft SharePoint

Mappatura nativa dei campi di Captika con i metadati configurati nelle tue liste SharePoint.

☁️

Amazon S3

Pubblicazione nel cloud selezionando il bucket S3 di destinazione e il nome del file.

Due modalità, una soluzione

Captika Desktop & Captika Service

Cattura assistita da persone e automazione non presidiata. Usale separatamente o combinale in una soluzione ibrida.

🖥️ Captika Desktop

Cattura assistita

Per operatori che validano i documenti in modo visivo: centri di digitalizzazione, aree amministrative e filiali.

  • Scansione in tempo reale da scanner TWAIN.
  • Validazione visiva delle immagini e correzione manuale dei dati OCR.
  • Controllo qualità: pagine bianche, rotazione e risoluzione.
  • Campi per documento o pagina, multiutente con profili e tracciabilità.
⚙️ Captika Service

Automazione 24/7

Un servizio Windows per elaborare grandi volumi in modo 100% automatico, senza intervento umano.

  • Elaborazione multithread di più lavori in simultanea.
  • Cattura automatica da cartelle, Thuban ed e-mail Microsoft 365.
  • Pianificazione delle attività: definisci cosa eseguire e quando.
  • Gestione errori, tentativi ripetuti e log completi per l'audit.
CaratteristicaDesktopService
OCR integrato (Tesseract)
OCR/ICR via API (Google Vision, Amazon Textract)
Motore di scripting C# / .NET 10
Validazioni esterne (DB / API)
Log di audit dettagliati
Profili utente e ruoli
Aggiornamento automatico dei template
Interfacce visive di revisione
Scalabilità orizzontale (multi-istanza)
Esecuzione 24/7 senza intervento

I motori nel cloud (Google Vision, Amazon Textract, OpenAI / Bedrock) vengono eseguiti con le credenziali del cliente stesso e il consumo è fatturato direttamente dal fornitore, senza intermediazione né ricarico da parte di Vivatia. L'OCR locale con Tesseract non ha costi per pagina.

Scegli Desktop se ti serve…

  • Validazione umana e correzione dei dati in tempo reale.
  • Un'interfaccia visiva intuitiva per utenti non tecnici.

Scegli Service se cerchi…

  • Elaborazione automatizzata e continua su larga scala.
  • Integrazione non presidiata con più fonti e destinazioni.

Prova Captika con i tuoi documenti

Inizia gratis con la Free Edition o richiedi un preventivo di Captika Server per l'elaborazione massiva.