Fonctionnalités de la plateforme

Tout le cycle documentaire, sur une seule plateforme.

Du scan à la publication : Captika capture depuis n'importe quelle source, extrait et valide les données par OCR et IA, reconnaît le type de document et publie le résultat là où vous en avez besoin. Avec règles, scripting .NET et traçabilité de bout en bout.

01
📥
Capture
Scanner, e-mail, dossiers, FTP, SharePoint, Thuban
02
🏷️
Métadonnées
Champs par lot, document et page, avec validation
03
🔍
OCR et IA
Tesseract, Textract, Google Vision et OpenAI
04
🧠
Reconnaissance
Modèles dynamiques et règles d'extraction
05
🚀
Publication
SQL, SharePoint, S3, Thuban, FTP et FileSystem
01 · Capture

Capture depuis n'importe quelle source

Connectez Captika aux canaux que vous utilisez déjà et automatisez l'entrée des documents sans changer votre façon de travailler. Un même flux, de nombreuses portes d'entrée.

  • Scanners physiques TWAIN avec numérisation en temps réel et contrôle qualité des images.
  • E-mail Office 365 : traitez les pièces jointes directement depuis les boîtes aux lettres d'entreprise dans le cloud.
  • File System local ou réseau avec dossiers et sous-dossiers, contrôle des fichiers en cours d'utilisation et renommage automatique.
  • Serveurs FTP / SFTP, idéaux pour automatiser les environnements distribués.
  • SharePoint via des recherches ViewXML et Thuban depuis les bacs de travail, requêtes et procédures stockées.

Sources de capture

Escáner TWAIN Office 365 Dossiers / HotFolders FTP / SFTP SharePoint Thuban

Configurez une ou plusieurs sources par travail de capture et laissez-les s'exécuter automatiquement.

Moteur de scripting

.NET 10 C# VB.NET WebServices / APIs

Personnalisez chaque événement du processus et connectez-vous à tout système externe. Des possibilités d'intégration quasi illimitées.

02 · Métadonnées et validation

Des données justes dès l'origine

Définissez les métadonnées en toute flexibilité et validez les informations avec vos systèmes avant de les publier. Moins d'erreurs, moins de reprises.

  • Trois niveaux de champs : par lot, par document et par page.
  • Listes déroulantes intelligentes générées depuis des bases de données (SQL dynamique), Thuban ou des listes SharePoint.
  • Validation et enrichissement automatiques avec des requêtes SQL, revalidation avec Thuban ou scripting sur mesure.
  • Moteur de scripting .NET 10 (C# / VB.NET) pour les règles et les appels à des WebServices ou API en temps réel.
03 · OCR et Intelligence Artificielle

OCR et IA de premier plan

Extrayez les informations clés de tout document avec les moteurs OCR les plus puissants du marché, et choisissez le meilleur selon le type de document.

🔤

Tesseract 5x (natif)

OCR local avec capture spatiale de chaque mot et ligne, évitant les lectures redondantes et permettant une validation visuelle à l'écran.

☁️

Amazon Textract

OCR dans le cloud du texte imprimé et manuscrit, avec lecture de tableaux, formulaires, signatures, visages et étiquettes dans les images.

👁️

Google Vision AI

Reconnaissance via API intégrée nativement, pour ajouter un autre grand moteur du marché à votre flux.

🤖

OpenAI / Bedrock

Exécutez des prompts intelligents sur les textes extraits pour améliorer l'extraction et la reconnaissance des données.

📄

PDF avec couche de texte

Avec PDFBox et PDFIUM : séparez les pages, détectez les signatures et exploitez la couche de texte d'origine pour plus de vitesse et de qualité.

Codes-barres

Lecture 1D, 2D et PatchCodes : CODE128, CODE39, DATAMATRIX, PDF417, EAN13, QR et plus, pour séparer et classer automatiquement.

04 · Reconnaissance intelligente

Modèles dynamiques pour tout document

Captika reconnaît aussi bien les documents structurés (factures, formulaires fiscaux, billets à ordre) que non structurés (comptes rendus, bilans, lettres, contrats), avec des règles d'extraction par champ.

  • Identifiez les documents par code-barres, champs extraits, ordre de page, taille, poids ou forme (image fingerprint).
  • Similarité textuelle : téléchargez une image d'exemple et définissez le seuil minimal de similarité pour reconnaître les documents futurs.
  • Sacs de mots par section du document, pour accélérer considérablement la création de modèles.
  • Règles de nettoyage NLP : dates, e-mails, nombres écrits, identifiants fiscaux (CUIT / CUIL / RUT), masques de données et plus.

IA appliquée (Amazon + OpenAI)

Comprehend — entités, phrases clés et sentiment
Comprehend Classification — classe par apprentissage (ML)
Rekognition — reconnaît des objets dans les images
OpenAI — prompts sur le texte extrait

En combinant ces outils, votre circuit de capture apprend et s'améliore avec le temps.

05 · Publication

Publiez vers plusieurs destinations, en parallèle

Générez des PDF ou TIF multipages —avec une couche de texte créée au moment de la capture— et publiez documents et métadonnées simultanément vers plusieurs systèmes, chacun avec sa propre configuration.

📁

FileSystem

Structures de dossiers dynamiques selon les champs reconnus, avec noms de fichiers configurables et fichiers texte paramétrables.

🗃️

Bases de données SQL

Publiez toutes les données capturées pour les exploiter dans des systèmes analytiques, de gestion ou de back-office.

🔒

FTP / SFTP

Transfert sécurisé de documents et de données, avec noms et métadonnées exportées entièrement configurables.

🌐

Portail Thuban

Indexation directe : chargement de nouveaux documents ou mise à jour des enregistrements existants.

🧩

Microsoft SharePoint

Mappage natif des champs de Captika avec les métadonnées configurées dans vos listes SharePoint.

☁️

Amazon S3

Publication dans le cloud en sélectionnant le bucket S3 de destination et le nom du fichier.

Deux modes, une solution

Captika Desktop & Captika Service

Capture assistée par des personnes et automatisation autonome. Utilisez-les séparément ou combinez-les en une solution hybride.

🖥️ Captika Desktop

Capture assistée

Pour les opérateurs qui valident les documents visuellement : centres de numérisation, services administratifs et agences.

  • Numérisation en temps réel depuis des scanners TWAIN.
  • Validation visuelle des images et correction manuelle des données OCR.
  • Contrôle qualité : pages blanches, rotation et résolution.
  • Champs par document ou page, multi-utilisateur avec profils et traçabilité.
⚙️ Captika Service

Automatisation 24/7

Un service Windows pour traiter de gros volumes 100% automatiquement, sans intervention humaine.

  • Traitement multithread de plusieurs travaux en simultané.
  • Capture automatique depuis des dossiers, Thuban et e-mail Microsoft 365.
  • Planification des tâches : définissez ce qui s'exécute et quand.
  • Gestion des erreurs, nouvelles tentatives et journaux complets pour l'audit.
FonctionnalitéDesktopService
OCR intégré (Tesseract)
OCR/ICR via API (Google Vision, Amazon Textract)
Moteur de scripting C# / .NET 10
Validations externes (DB / API)
Journaux d'audit détaillés
Profils utilisateurs et rôles
Mise à jour automatique des modèles
Interfaces visuelles de révision
Scalabilité horizontale (multi-instance)
Exécution 24/7 sans intervention

Les moteurs dans le cloud (Google Vision, Amazon Textract, OpenAI / Bedrock) s'exécutent avec les identifiants du client lui-même et leur consommation est facturée directement par le fournisseur, sans intermédiation ni marge de Vivatia. L'OCR local avec Tesseract n'a aucun coût par page.

Choisissez Desktop s'il vous faut…

  • Une validation humaine et la correction des données en temps réel.
  • Une interface visuelle conviviale pour les utilisateurs non techniques.

Choisissez Service si vous cherchez…

  • Un traitement automatisé et continu à grande échelle.
  • Une intégration autonome avec de multiples sources et destinations.

Testez Captika avec vos propres documents

Commencez gratuitement avec la Free Edition ou demandez un devis pour Captika Server pour le traitement de masse.