Funktionen der Plattform

Der gesamte Dokumentenprozess, in einer einzigen Plattform.

Vom Scan bis zur Veröffentlichung: Captika erfasst aus jeder Quelle, extrahiert und validiert Daten mit OCR und KI, erkennt den Dokumenttyp und veröffentlicht das Ergebnis dort, wo du es brauchst. Mit Regeln, .NET-Scripting und durchgängiger Nachvollziehbarkeit.

01
📥
Erfassung
Scanner, E-Mail, Ordner, FTP, SharePoint, Thuban
02
🏷️
Metadaten
Felder pro Stapel, Dokument und Seite, mit Validierung
03
🔍
OCR & KI
Tesseract, Textract, Google Vision und OpenAI
04
🧠
Erkennung
Dynamische Vorlagen und Extraktionsregeln
05
🚀
Veröffentlichung
SQL, SharePoint, S3, Thuban, FTP und FileSystem
01 · Erfassung

Erfassung aus jeder Quelle

Verbinde Captika mit den Kanälen, die du bereits nutzt, und automatisiere den Dokumenteneingang, ohne deine Arbeitsweise zu ändern. Ein Ablauf, viele Eingänge.

  • Physische TWAIN-Scanner mit Echtzeit-Scan und Bildqualitätskontrolle.
  • Office-365-E-Mail: verarbeite Anhänge direkt aus Unternehmenspostfächern in der Cloud.
  • Lokales oder Netzwerk-File-System mit Ordnern und Unterordnern, Kontrolle in Verwendung befindlicher Dateien und automatischer Umbenennung.
  • FTP-/SFTP-Server, ideal zur Automatisierung verteilter Umgebungen.
  • SharePoint über ViewXML-Suchen und Thuban aus Arbeitskörben, Abfragen und Stored Procedures.

Erfassungsquellen

Escáner TWAIN Office 365 Ordner / HotFolders FTP / SFTP SharePoint Thuban

Konfiguriere eine oder mehrere Quellen pro Erfassungsauftrag und lass sie automatisch laufen.

Scripting-Engine

.NET 10 C# VB.NET WebServices / APIs

Passe jedes Ereignis des Prozesses an und verbinde dich mit jedem externen System. Praktisch unbegrenzte Integrationsmöglichkeiten.

02 · Metadaten und Validierung

Korrekte Daten von Anfang an

Definiere Metadaten mit voller Flexibilität und validiere die Informationen mit deinen Systemen, bevor du sie veröffentlichst. Weniger Fehler, weniger Nacharbeit.

  • Drei Feldebenen: pro Stapel, pro Dokument und pro Seite.
  • Intelligente Dropdown-Listen, erzeugt aus Datenbanken (dynamisches SQL), Thuban oder SharePoint-Listen.
  • Automatische Validierung und Anreicherung mit SQL-Abfragen, erneuter Validierung gegen Thuban oder maßgeschneidertem Scripting.
  • .NET-10-Scripting-Engine (C# / VB.NET) für Regeln und Echtzeit-Aufrufe an WebServices oder APIs.
03 · OCR und Künstliche Intelligenz

OCR und KI der Spitzenklasse

Extrahiere Schlüsselinformationen aus jedem Dokument mit den leistungsstärksten OCR-Engines am Markt und wähle die beste je nach Dokumenttyp.

🔤

Tesseract 5x (nativ)

Lokales OCR mit räumlicher Erfassung jedes Worts und jeder Zeile, vermeidet redundante Lesungen und ermöglicht visuelle Validierung am Bildschirm.

☁️

Amazon Textract

Cloud-OCR für gedruckten und handschriftlichen Text, mit Lesen von Tabellen, Formularen, Unterschriften, Gesichtern und Etiketten in Bildern.

👁️

Google Vision AI

Erkennung per API, nativ integriert, um eine weitere führende Marktengine in deinen Ablauf aufzunehmen.

🤖

OpenAI / Bedrock

Führe intelligente Prompts über die extrahierten Texte aus, um Extraktion und Datenerkennung zu verbessern.

📄

PDFs mit Textebene

Mit PDFBox und PDFIUM: Seiten trennen, Unterschriften erkennen und die originale Textebene für mehr Geschwindigkeit und Qualität nutzen.

Barcodes

Lesen von 1D, 2D und PatchCodes: CODE128, CODE39, DATAMATRIX, PDF417, EAN13, QR und mehr, zum automatischen Trennen und Klassifizieren.

04 · Intelligente Erkennung

Dynamische Vorlagen für jedes Dokument

Captika erkennt sowohl strukturierte Dokumente (Rechnungen, Steuerformulare, Schuldscheine) als auch unstrukturierte (Protokolle, Bilanzen, Briefe, Verträge), mit Extraktionsregeln pro Feld.

  • Identifiziere Dokumente per Barcode, extrahierten Feldern, Seitenreihenfolge, Größe, Gewicht oder Form (Image Fingerprint).
  • Textähnlichkeit: Lade ein Beispielbild hoch und lege die Mindestähnlichkeit fest, um künftige Dokumente zu erkennen.
  • Wortsäcke pro Dokumentabschnitt, um die Vorlagenerstellung deutlich zu beschleunigen.
  • Regeln zur NLP-Bereinigung: Datumsangaben, E-Mails, ausgeschriebene Zahlen, Steuer-IDs (CUIT / CUIL / RUT), Datenmasken und mehr.

Angewandte KI (Amazon + OpenAI)

Comprehend — Entitäten, Schlüsselphrasen und Stimmung
Comprehend Classification — klassifiziert per Lernen (ML)
Rekognition — erkennt Objekte in Bildern
OpenAI — Prompts über den extrahierten Text

Durch die Kombination dieser Werkzeuge lernt dein Erfassungskreislauf und verbessert sich mit der Zeit.

05 · Veröffentlichung

Veröffentliche parallel an mehrere Ziele

Erzeuge mehrseitige PDFs oder TIFs —mit einer bei der Erfassung erstellten Textebene— und veröffentliche Dokumente und Metadaten gleichzeitig in mehreren Systemen, jeweils mit eigener Konfiguration.

📁

FileSystem

Dynamische Ordnerstrukturen anhand der erkannten Felder, mit konfigurierbaren Dateinamen und parametrisierbaren Textdateien.

🗃️

SQL-Datenbanken

Veröffentliche alle erfassten Daten zur Nutzung in Analyse-, Verwaltungs- oder Back-Office-Systemen.

🔒

FTP / SFTP

Sichere Übertragung von Dokumenten und Daten, mit vollständig konfigurierbaren Namen und exportierten Metadaten.

🌐

Thuban-Portal

Direkte Indizierung: Hochladen neuer Dokumente oder Aktualisieren bestehender Datensätze.

🧩

Microsoft SharePoint

Native Zuordnung der Captika-Felder zu den in deinen SharePoint-Listen konfigurierten Metadaten.

☁️

Amazon S3

Cloud-Veröffentlichung durch Auswahl des Ziel-S3-Buckets und des Dateinamens.

Zwei Modi, eine Lösung

Captika Desktop & Captika Service

Menschlich unterstützte Erfassung und unbeaufsichtigte Automatisierung. Nutze sie getrennt oder kombiniere sie zu einer hybriden Lösung.

🖥️ Captika Desktop

Unterstützte Erfassung

Für Bediener, die Dokumente visuell prüfen: Digitalisierungszentren, Verwaltungsbereiche und Filialen.

  • Echtzeit-Scan von TWAIN-Scannern.
  • Visuelle Validierung von Bildern und manuelle Korrektur von OCR-Daten.
  • Qualitätskontrolle: leere Seiten, Drehung und Auflösung.
  • Felder pro Dokument oder Seite, mehrbenutzerfähig mit Profilen und Nachvollziehbarkeit.
⚙️ Captika Service

24/7-Automatisierung

Ein Windows-Dienst zur 100% automatischen Verarbeitung großer Mengen, ohne menschliches Eingreifen.

  • Multithread-Verarbeitung mehrerer Aufträge gleichzeitig.
  • Automatische Erfassung aus Ordnern, Thuban und Microsoft-365-E-Mail.
  • Aufgabenplanung: lege fest, was wann ausgeführt wird.
  • Fehlerbehandlung, Wiederholungen und vollständige Protokolle für Audits.
FunktionDesktopService
Integriertes OCR (Tesseract)
OCR/ICR über API (Google Vision, Amazon Textract)
Scripting-Engine C# / .NET 10
Externe Validierungen (DB / API)
Detaillierte Audit-Protokolle
Benutzerprofile und Rollen
Automatische Vorlagen-Updates
Visuelle Prüfoberflächen
Horizontale Skalierbarkeit (Multi-Instanz)
24/7-Ausführung ohne Eingriff

Die Cloud-Engines (Google Vision, Amazon Textract, OpenAI / Bedrock) laufen mit den Zugangsdaten des Kunden selbst, und ihr Verbrauch wird direkt vom Anbieter abgerechnet — ohne Vermittlung oder Aufschlag durch Vivatia. Lokales OCR mit Tesseract verursacht keine Kosten pro Seite.

Wähle Desktop, wenn du brauchst…

  • Menschliche Validierung und Datenkorrektur in Echtzeit.
  • Eine benutzerfreundliche visuelle Oberfläche für nicht-technische Anwender.

Wähle Service, wenn du suchst…

  • Automatisierte, kontinuierliche Verarbeitung im großen Maßstab.
  • Unbeaufsichtigte Integration mit mehreren Quellen und Zielen.

Teste Captika mit deinen eigenen Dokumenten

Starte kostenlos mit der Free Edition oder fordere ein Angebot für Captika Server für die Massenverarbeitung an.