Recursos da plataforma

Todo o ciclo documental, em uma só plataforma.

Do escaneamento à publicação: o Captika captura de qualquer fonte, extrai e valida os dados com OCR e IA, reconhece o tipo de documento e publica o resultado onde você precisar. Com regras, scripting .NET e rastreabilidade de ponta a ponta.

01
📥
Captura
Scanner, e-mail, pastas, FTP, SharePoint, Thuban
02
🏷️
Metadados
Campos por lote, documento e página, com validação
03
🔍
OCR e IA
Tesseract, Textract, Google Vision e OpenAI
04
🧠
Reconhecimento
Templates dinâmicos e regras de extração
05
🚀
Publicação
SQL, SharePoint, S3, Thuban, FTP e FileSystem
01 · Captura

Captura de qualquer fonte

Conecte o Captika aos canais que você já usa e automatize a entrada de documentos sem mudar sua forma de trabalhar. Um mesmo fluxo, muitas portas de entrada.

  • Scanners físicos TWAIN com escaneamento em tempo real e controle de qualidade de imagem.
  • E-mail Office 365: processa anexos diretamente de caixas corporativas na nuvem.
  • File System local ou de rede com pastas e subpastas, controle de arquivos em uso e renomeação automática.
  • Servidores FTP / SFTP, ideais para automatizar ambientes distribuídos.
  • SharePoint por buscas ViewXML e Thuban a partir de bandejas, buscas e Stored Procedures.

Fontes de captura

Escáner TWAIN Office 365 Pastas / HotFolders FTP / SFTP SharePoint Thuban

Configure uma ou várias fontes por trabalho de captura e deixe-as rodar automaticamente.

Motor de scripting

.NET 10 C# VB.NET WebServices / APIs

Personalize cada evento do processo e conecte-se a qualquer sistema externo. Possibilidades de integração praticamente ilimitadas.

02 · Metadados e validações

Dados corretos desde a origem

Defina metadados com total flexibilidade e valide as informações contra seus sistemas antes de publicá-las. Menos erros, menos retrabalho.

  • Três níveis de campos: por lote, por documento e por página.
  • Listas suspensas inteligentes geradas a partir de bancos de dados (SQL dinâmico), Thuban ou listas do SharePoint.
  • Validação e enriquecimento automáticos com consultas SQL, revalidação contra o Thuban ou scripting sob medida.
  • Motor de scripting .NET 10 (C# / VB.NET) para regras e chamadas a WebServices ou APIs em tempo real.
03 · OCR e Inteligência Artificial

OCR e IA de primeiro nível

Extraia informações-chave de qualquer documento com os motores de OCR mais potentes do mercado e escolha o melhor para cada tipo de documento.

🔤

Tesseract 5x (nativo)

OCR local com captura espacial de cada palavra e linha, evitando leituras redundantes e permitindo validação visual na tela.

☁️

Amazon Textract

OCR na nuvem de texto impresso e manuscrito, com leitura de tabelas, formulários, assinaturas, rostos e etiquetas em imagens.

👁️

Google Vision AI

Reconhecimento via API integrado de forma nativa, para somar outro dos grandes motores do mercado ao seu fluxo.

🤖

OpenAI / Bedrock

Execute prompts inteligentes sobre os textos extraídos para melhorar a extração e o reconhecimento de dados.

📄

PDFs com camada de texto

Com PDFBox e PDFIUM: separa páginas, detecta assinaturas e aproveita a camada de texto original para mais velocidade e qualidade.

Códigos de barras

Leitura 1D, 2D e PatchCodes: CODE128, CODE39, DATAMATRIX, PDF417, EAN13, QR e mais, para separar e classificar automaticamente.

04 · Reconhecimento inteligente

Templates dinâmicos para qualquer documento

O Captika reconhece tanto documentos estruturados (faturas, formulários fiscais, notas promissórias) quanto não estruturados (atas, balanços, cartas, contratos), com regras de extração por campo.

  • Identifica documentos por código de barras, campos extraídos, ordem de página, tamanho, peso ou forma (image fingerprint).
  • Similaridade textual: envie uma imagem de exemplo e defina o nível mínimo de similaridade para reconhecer documentos futuros.
  • Sacos de palavras por seção do documento, para acelerar de forma notável a montagem de templates.
  • Regras de limpeza NLP: datas, e-mails, números por extenso, CUIT / CUIL / RUT, máscaras de dados e mais.

IA aplicada (Amazon + OpenAI)

Comprehend — entidades, frases-chave e sentimento
Comprehend Classification — classifica por aprendizado (ML)
Rekognition — reconhece objetos dentro de imagens
OpenAI — prompts sobre o texto extraído

Combinando essas ferramentas, seu circuito de captura aprende e melhora com o tempo.

05 · Publicação

Publique em múltiplos destinos, em paralelo

Gere PDF ou TIF multipágina —com camada de texto criada no momento da captura— e publique documentos e metadados simultaneamente em vários sistemas, com configuração própria para cada um.

📁

FileSystem

Estruturas de pastas dinâmicas conforme os campos reconhecidos, com nomes de arquivo configuráveis e arquivos de texto parametrizáveis.

🗃️

Bancos de dados SQL

Publique todos os dados capturados para uso em sistemas analíticos, de gestão ou back-office.

🔒

FTP / SFTP

Transferência segura de documentos e dados, com nomes e metadados exportados totalmente configuráveis.

🌐

Portal Thuban

Indexação direta: carga de novos documentos ou atualização de registros existentes.

🧩

Microsoft SharePoint

Mapeamento nativo dos campos do Captika com os metadados configurados em suas listas do SharePoint.

☁️

Amazon S3

Publicação na nuvem selecionando o bucket S3 de destino e o nome do arquivo.

Duas modalidades, uma solução

Captika Desktop & Captika Service

Captura assistida por pessoas e automação não assistida. Use-as separadamente ou combine-as em uma solução híbrida.

🖥️ Captika Desktop

Captura assistida

Para operadores que validam documentos de forma visual: centros de digitalização, áreas administrativas e filiais.

  • Escaneamento em tempo real a partir de scanners TWAIN.
  • Validação visual de imagens e correção manual de dados de OCR.
  • Controle de qualidade: páginas em branco, rotação e resolução.
  • Campos por documento ou página, multiusuário com perfis e rastreabilidade.
⚙️ Captika Service

Automação 24/7

Serviço do Windows para processar grandes volumes de forma 100% automática, sem intervenção humana.

  • Processamento multithread de vários trabalhos em simultâneo.
  • Captura automática de pastas, Thuban e e-mail Microsoft 365.
  • Agenda de tarefas: defina o que roda e quando.
  • Tratamento de erros, novas tentativas e logs completos para auditoria.
CaracterísticaDesktopService
OCR integrado (Tesseract)
OCR/ICR via API (Google Vision, Amazon Textract)
Motor de scripting C# / .NET 10
Validações externas (DB / API)
Logs de auditoria detalhados
Perfis de usuário e funções
Atualização automática de templates
Interfaces visuais de revisão
Escalabilidade horizontal (multi-instância)
Execução 24/7 sem intervenção

Os motores na nuvem (Google Vision, Amazon Textract, OpenAI / Bedrock) são executados com as credenciais do próprio cliente e o consumo é faturado diretamente pelo provedor, sem intermediação nem acréscimo da Vivatia. O OCR local com Tesseract não tem custo por página.

Escolha Desktop se você precisa de…

  • Validação humana e correção de dados em tempo real.
  • Uma interface visual amigável para usuários não técnicos.

Escolha Service se você busca…

  • Processamento automatizado e contínuo em grande escala.
  • Integração não assistida com múltiplas fontes e destinos.

Teste o Captika com seus próprios documentos

Comece grátis com o Free Edition ou peça um orçamento do Captika Server para processamento em massa.