Tout le cycle documentaire, sur une seule plateforme.
Du scan à la publication : Captika capture depuis n'importe quelle source, extrait et valide les données par OCR et IA, reconnaît le type de document et publie le résultat là où vous en avez besoin. Avec règles, scripting .NET et traçabilité de bout en bout.
Capture depuis n'importe quelle source
Connectez Captika aux canaux que vous utilisez déjà et automatisez l'entrée des documents sans changer votre façon de travailler. Un même flux, de nombreuses portes d'entrée.
- Scanners physiques TWAIN avec numérisation en temps réel et contrôle qualité des images.
- E-mail Office 365 : traitez les pièces jointes directement depuis les boîtes aux lettres d'entreprise dans le cloud.
- File System local ou réseau avec dossiers et sous-dossiers, contrôle des fichiers en cours d'utilisation et renommage automatique.
- Serveurs FTP / SFTP, idéaux pour automatiser les environnements distribués.
- SharePoint via des recherches ViewXML et Thuban depuis les bacs de travail, requêtes et procédures stockées.
Sources de capture
Configurez une ou plusieurs sources par travail de capture et laissez-les s'exécuter automatiquement.
Moteur de scripting
Personnalisez chaque événement du processus et connectez-vous à tout système externe. Des possibilités d'intégration quasi illimitées.
Des données justes dès l'origine
Définissez les métadonnées en toute flexibilité et validez les informations avec vos systèmes avant de les publier. Moins d'erreurs, moins de reprises.
- Trois niveaux de champs : par lot, par document et par page.
- Listes déroulantes intelligentes générées depuis des bases de données (SQL dynamique), Thuban ou des listes SharePoint.
- Validation et enrichissement automatiques avec des requêtes SQL, revalidation avec Thuban ou scripting sur mesure.
- Moteur de scripting .NET 10 (C# / VB.NET) pour les règles et les appels à des WebServices ou API en temps réel.
OCR et IA de premier plan
Extrayez les informations clés de tout document avec les moteurs OCR les plus puissants du marché, et choisissez le meilleur selon le type de document.
Tesseract 5x (natif)
OCR local avec capture spatiale de chaque mot et ligne, évitant les lectures redondantes et permettant une validation visuelle à l'écran.
Amazon Textract
OCR dans le cloud du texte imprimé et manuscrit, avec lecture de tableaux, formulaires, signatures, visages et étiquettes dans les images.
Google Vision AI
Reconnaissance via API intégrée nativement, pour ajouter un autre grand moteur du marché à votre flux.
OpenAI / Bedrock
Exécutez des prompts intelligents sur les textes extraits pour améliorer l'extraction et la reconnaissance des données.
PDF avec couche de texte
Avec PDFBox et PDFIUM : séparez les pages, détectez les signatures et exploitez la couche de texte d'origine pour plus de vitesse et de qualité.
Codes-barres
Lecture 1D, 2D et PatchCodes : CODE128, CODE39, DATAMATRIX, PDF417, EAN13, QR et plus, pour séparer et classer automatiquement.
Modèles dynamiques pour tout document
Captika reconnaît aussi bien les documents structurés (factures, formulaires fiscaux, billets à ordre) que non structurés (comptes rendus, bilans, lettres, contrats), avec des règles d'extraction par champ.
- Identifiez les documents par code-barres, champs extraits, ordre de page, taille, poids ou forme (image fingerprint).
- Similarité textuelle : téléchargez une image d'exemple et définissez le seuil minimal de similarité pour reconnaître les documents futurs.
- Sacs de mots par section du document, pour accélérer considérablement la création de modèles.
- Règles de nettoyage NLP : dates, e-mails, nombres écrits, identifiants fiscaux (CUIT / CUIL / RUT), masques de données et plus.
IA appliquée (Amazon + OpenAI)
En combinant ces outils, votre circuit de capture apprend et s'améliore avec le temps.
Publiez vers plusieurs destinations, en parallèle
Générez des PDF ou TIF multipages —avec une couche de texte créée au moment de la capture— et publiez documents et métadonnées simultanément vers plusieurs systèmes, chacun avec sa propre configuration.
FileSystem
Structures de dossiers dynamiques selon les champs reconnus, avec noms de fichiers configurables et fichiers texte paramétrables.
Bases de données SQL
Publiez toutes les données capturées pour les exploiter dans des systèmes analytiques, de gestion ou de back-office.
FTP / SFTP
Transfert sécurisé de documents et de données, avec noms et métadonnées exportées entièrement configurables.
Portail Thuban
Indexation directe : chargement de nouveaux documents ou mise à jour des enregistrements existants.
Microsoft SharePoint
Mappage natif des champs de Captika avec les métadonnées configurées dans vos listes SharePoint.
Amazon S3
Publication dans le cloud en sélectionnant le bucket S3 de destination et le nom du fichier.
Captika Desktop & Captika Service
Capture assistée par des personnes et automatisation autonome. Utilisez-les séparément ou combinez-les en une solution hybride.
Capture assistée
Pour les opérateurs qui valident les documents visuellement : centres de numérisation, services administratifs et agences.
- Numérisation en temps réel depuis des scanners TWAIN.
- Validation visuelle des images et correction manuelle des données OCR.
- Contrôle qualité : pages blanches, rotation et résolution.
- Champs par document ou page, multi-utilisateur avec profils et traçabilité.
Automatisation 24/7
Un service Windows pour traiter de gros volumes 100% automatiquement, sans intervention humaine.
- Traitement multithread de plusieurs travaux en simultané.
- Capture automatique depuis des dossiers, Thuban et e-mail Microsoft 365.
- Planification des tâches : définissez ce qui s'exécute et quand.
- Gestion des erreurs, nouvelles tentatives et journaux complets pour l'audit.
| Fonctionnalité | Desktop | Service |
|---|---|---|
| OCR intégré (Tesseract) | ✓ | ✓ |
| OCR/ICR via API (Google Vision, Amazon Textract) | ✓ | ✓ |
| Moteur de scripting C# / .NET 10 | ✓ | ✓ |
| Validations externes (DB / API) | ✓ | ✓ |
| Journaux d'audit détaillés | ✓ | ✓ |
| Profils utilisateurs et rôles | ✓ | ✓ |
| Mise à jour automatique des modèles | ✓ | ✓ |
| Interfaces visuelles de révision | ✓ | — |
| Scalabilité horizontale (multi-instance) | — | ✓ |
| Exécution 24/7 sans intervention | — | ✓ |
Les moteurs dans le cloud (Google Vision, Amazon Textract, OpenAI / Bedrock) s'exécutent avec les identifiants du client lui-même et leur consommation est facturée directement par le fournisseur, sans intermédiation ni marge de Vivatia. L'OCR local avec Tesseract n'a aucun coût par page.
Choisissez Desktop s'il vous faut…
- Une validation humaine et la correction des données en temps réel.
- Une interface visuelle conviviale pour les utilisateurs non techniques.
Choisissez Service si vous cherchez…
- Un traitement automatisé et continu à grande échelle.
- Une intégration autonome avec de multiples sources et destinations.
Testez Captika avec vos propres documents
Commencez gratuitement avec la Free Edition ou demandez un devis pour Captika Server pour le traitement de masse.
