Der gesamte Dokumentenprozess, in einer einzigen Plattform.
Vom Scan bis zur Veröffentlichung: Captika erfasst aus jeder Quelle, extrahiert und validiert Daten mit OCR und KI, erkennt den Dokumenttyp und veröffentlicht das Ergebnis dort, wo du es brauchst. Mit Regeln, .NET-Scripting und durchgängiger Nachvollziehbarkeit.
Erfassung aus jeder Quelle
Verbinde Captika mit den Kanälen, die du bereits nutzt, und automatisiere den Dokumenteneingang, ohne deine Arbeitsweise zu ändern. Ein Ablauf, viele Eingänge.
- Physische TWAIN-Scanner mit Echtzeit-Scan und Bildqualitätskontrolle.
- Office-365-E-Mail: verarbeite Anhänge direkt aus Unternehmenspostfächern in der Cloud.
- Lokales oder Netzwerk-File-System mit Ordnern und Unterordnern, Kontrolle in Verwendung befindlicher Dateien und automatischer Umbenennung.
- FTP-/SFTP-Server, ideal zur Automatisierung verteilter Umgebungen.
- SharePoint über ViewXML-Suchen und Thuban aus Arbeitskörben, Abfragen und Stored Procedures.
Erfassungsquellen
Konfiguriere eine oder mehrere Quellen pro Erfassungsauftrag und lass sie automatisch laufen.
Scripting-Engine
Passe jedes Ereignis des Prozesses an und verbinde dich mit jedem externen System. Praktisch unbegrenzte Integrationsmöglichkeiten.
Korrekte Daten von Anfang an
Definiere Metadaten mit voller Flexibilität und validiere die Informationen mit deinen Systemen, bevor du sie veröffentlichst. Weniger Fehler, weniger Nacharbeit.
- Drei Feldebenen: pro Stapel, pro Dokument und pro Seite.
- Intelligente Dropdown-Listen, erzeugt aus Datenbanken (dynamisches SQL), Thuban oder SharePoint-Listen.
- Automatische Validierung und Anreicherung mit SQL-Abfragen, erneuter Validierung gegen Thuban oder maßgeschneidertem Scripting.
- .NET-10-Scripting-Engine (C# / VB.NET) für Regeln und Echtzeit-Aufrufe an WebServices oder APIs.
OCR und KI der Spitzenklasse
Extrahiere Schlüsselinformationen aus jedem Dokument mit den leistungsstärksten OCR-Engines am Markt und wähle die beste je nach Dokumenttyp.
Tesseract 5x (nativ)
Lokales OCR mit räumlicher Erfassung jedes Worts und jeder Zeile, vermeidet redundante Lesungen und ermöglicht visuelle Validierung am Bildschirm.
Amazon Textract
Cloud-OCR für gedruckten und handschriftlichen Text, mit Lesen von Tabellen, Formularen, Unterschriften, Gesichtern und Etiketten in Bildern.
Google Vision AI
Erkennung per API, nativ integriert, um eine weitere führende Marktengine in deinen Ablauf aufzunehmen.
OpenAI / Bedrock
Führe intelligente Prompts über die extrahierten Texte aus, um Extraktion und Datenerkennung zu verbessern.
PDFs mit Textebene
Mit PDFBox und PDFIUM: Seiten trennen, Unterschriften erkennen und die originale Textebene für mehr Geschwindigkeit und Qualität nutzen.
Barcodes
Lesen von 1D, 2D und PatchCodes: CODE128, CODE39, DATAMATRIX, PDF417, EAN13, QR und mehr, zum automatischen Trennen und Klassifizieren.
Dynamische Vorlagen für jedes Dokument
Captika erkennt sowohl strukturierte Dokumente (Rechnungen, Steuerformulare, Schuldscheine) als auch unstrukturierte (Protokolle, Bilanzen, Briefe, Verträge), mit Extraktionsregeln pro Feld.
- Identifiziere Dokumente per Barcode, extrahierten Feldern, Seitenreihenfolge, Größe, Gewicht oder Form (Image Fingerprint).
- Textähnlichkeit: Lade ein Beispielbild hoch und lege die Mindestähnlichkeit fest, um künftige Dokumente zu erkennen.
- Wortsäcke pro Dokumentabschnitt, um die Vorlagenerstellung deutlich zu beschleunigen.
- Regeln zur NLP-Bereinigung: Datumsangaben, E-Mails, ausgeschriebene Zahlen, Steuer-IDs (CUIT / CUIL / RUT), Datenmasken und mehr.
Angewandte KI (Amazon + OpenAI)
Durch die Kombination dieser Werkzeuge lernt dein Erfassungskreislauf und verbessert sich mit der Zeit.
Veröffentliche parallel an mehrere Ziele
Erzeuge mehrseitige PDFs oder TIFs —mit einer bei der Erfassung erstellten Textebene— und veröffentliche Dokumente und Metadaten gleichzeitig in mehreren Systemen, jeweils mit eigener Konfiguration.
FileSystem
Dynamische Ordnerstrukturen anhand der erkannten Felder, mit konfigurierbaren Dateinamen und parametrisierbaren Textdateien.
SQL-Datenbanken
Veröffentliche alle erfassten Daten zur Nutzung in Analyse-, Verwaltungs- oder Back-Office-Systemen.
FTP / SFTP
Sichere Übertragung von Dokumenten und Daten, mit vollständig konfigurierbaren Namen und exportierten Metadaten.
Thuban-Portal
Direkte Indizierung: Hochladen neuer Dokumente oder Aktualisieren bestehender Datensätze.
Microsoft SharePoint
Native Zuordnung der Captika-Felder zu den in deinen SharePoint-Listen konfigurierten Metadaten.
Amazon S3
Cloud-Veröffentlichung durch Auswahl des Ziel-S3-Buckets und des Dateinamens.
Captika Desktop & Captika Service
Menschlich unterstützte Erfassung und unbeaufsichtigte Automatisierung. Nutze sie getrennt oder kombiniere sie zu einer hybriden Lösung.
Unterstützte Erfassung
Für Bediener, die Dokumente visuell prüfen: Digitalisierungszentren, Verwaltungsbereiche und Filialen.
- Echtzeit-Scan von TWAIN-Scannern.
- Visuelle Validierung von Bildern und manuelle Korrektur von OCR-Daten.
- Qualitätskontrolle: leere Seiten, Drehung und Auflösung.
- Felder pro Dokument oder Seite, mehrbenutzerfähig mit Profilen und Nachvollziehbarkeit.
24/7-Automatisierung
Ein Windows-Dienst zur 100% automatischen Verarbeitung großer Mengen, ohne menschliches Eingreifen.
- Multithread-Verarbeitung mehrerer Aufträge gleichzeitig.
- Automatische Erfassung aus Ordnern, Thuban und Microsoft-365-E-Mail.
- Aufgabenplanung: lege fest, was wann ausgeführt wird.
- Fehlerbehandlung, Wiederholungen und vollständige Protokolle für Audits.
| Funktion | Desktop | Service |
|---|---|---|
| Integriertes OCR (Tesseract) | ✓ | ✓ |
| OCR/ICR über API (Google Vision, Amazon Textract) | ✓ | ✓ |
| Scripting-Engine C# / .NET 10 | ✓ | ✓ |
| Externe Validierungen (DB / API) | ✓ | ✓ |
| Detaillierte Audit-Protokolle | ✓ | ✓ |
| Benutzerprofile und Rollen | ✓ | ✓ |
| Automatische Vorlagen-Updates | ✓ | ✓ |
| Visuelle Prüfoberflächen | ✓ | — |
| Horizontale Skalierbarkeit (Multi-Instanz) | — | ✓ |
| 24/7-Ausführung ohne Eingriff | — | ✓ |
Die Cloud-Engines (Google Vision, Amazon Textract, OpenAI / Bedrock) laufen mit den Zugangsdaten des Kunden selbst, und ihr Verbrauch wird direkt vom Anbieter abgerechnet — ohne Vermittlung oder Aufschlag durch Vivatia. Lokales OCR mit Tesseract verursacht keine Kosten pro Seite.
Wähle Desktop, wenn du brauchst…
- Menschliche Validierung und Datenkorrektur in Echtzeit.
- Eine benutzerfreundliche visuelle Oberfläche für nicht-technische Anwender.
Wähle Service, wenn du suchst…
- Automatisierte, kontinuierliche Verarbeitung im großen Maßstab.
- Unbeaufsichtigte Integration mit mehreren Quellen und Zielen.
Teste Captika mit deinen eigenen Dokumenten
Starte kostenlos mit der Free Edition oder fordere ein Angebot für Captika Server für die Massenverarbeitung an.
