Plataforma de captura documental · Desktop & Service

DIGITALIZÁ TUS DOCUMENTOS

Captika digitaliza desde cualquier fuente, extrae los datos con OCR e IA, valida y publica en tus sistemas. Empezá gratis con la Free Edition.

6fuentes y destinos
4motores de OCR e IA
TWAINescaneo directo
C# / .NETscripting nativo
El recorrido de un lote

Cinco etapas, y en ninguna hace falta que alguien transcriba.

Un lote entra por cualquiera de las seis fuentes y sale publicado en uno o varios destinos a la vez. Lo que ocurre en el medio se configura una vez y se repite todos los días.

01

Captura

El documento entra desde el escáner, una carpeta, un correo o un repositorio.

entra papel o archivo
sale lote de imágenes
02

Metadatos

Campos por lote, por documento y por página, con listas y validaciones contra tus bases.

entra lote
sale lote indexado
03

OCR e IA

El texto se obtiene con el motor más barato que alcance, y se escala sólo si hace falta.

entra imagen
sale capa de texto
04

Reconocimiento

Se identifica qué documento es y se extraen y limpian los campos con reglas.

entra texto
sale campos
05

Publicación

Documento y datos se escriben en paralelo en todos los destinos configurados.

entra campos
sale PDF + registro
01
Captura

Seis orígenes, una sola bandeja de trabajo.

Captika no obliga a cambiar cómo llega el documento. Se conecta al canal que ya existe —el escáner de la sucursal, la casilla de correo, la carpeta de red— y a partir de ahí todo sigue el mismo camino.

Escáner TWAIN

Escaneo en tiempo real desde cualquier equipo compatible, con control de calidad de imagen: detección de páginas en blanco, rotación y resolución.

Thuban Software

Captura desde bandejas de trabajo, búsquedas por campos y stored procedures del propio repositorio documental.

Microsoft 365

Casillas de correo corporativas en la nube: el adjunto que llega se convierte en un lote sin que nadie lo baje.

SharePoint

Búsquedas ViewXML sobre listas y bibliotecas existentes.

FileSystem

Carpetas locales o de red con procesamiento de subcarpetas, control de archivos en uso y renombrado automático.

FTP / SFTP

Para entornos distribuidos, sucursales y proveedores que depositan documentación.
Captika Desktop · Lote en proceso1 documento · 500 imágenes
Captika Desktop con un lote abierto: miniaturas de las páginas, visor del documento y panel de campos
El operador ve las miniaturas del lote, el documento ampliado y los campos a la derecha, en la misma pantalla. Acá el lote va por la imagen 973 de 1.000. Deslizá la imagen para recorrerla.
02
Metadatos y validaciones

El dato se carga una vez, y se comprueba contra tu sistema.

Un campo mal cargado en la captura se arrastra hasta el final del circuito. Captika lo evita de dos formas: ofreciendo sólo los valores que existen, y revalidando contra las mismas bases donde vive la verdad.

Los campos se declaran en tres niveles, según a qué pertenece el dato:

Por lote

Lo que vale para toda la tanda: la sucursal que escanea, la fecha de proceso, el operador.

Por documento

Los datos propios del comprobante: número, fecha, CUIT, importe.

Por página

Lo que cambia hoja a hoja, para expedientes donde cada foja es una unidad.

Las listas desplegables no se escriben a mano: se generan desde donde ya están los datos, y una lista puede depender de lo que se eligió en otro campo.

Base de datos

Consultas SQL dinámicas, que pueden tomar valores de otros campos del mismo documento.

Thuban Software

Integración directa con ThubanExecSP y ThubanQueries por API nativa.

SharePoint

Los campos de Captika se mapean contra los metadatos de listas ya existentes.

Y sobre el valor cargado corren las validaciones, que además pueden completar el dato en el momento:

Contra SQL

Que el proveedor exista, que el contrato esté vigente, que el legajo corresponda a esa persona.

Contra Thuban

Revalidación contra los datos que ya viven en el repositorio documental.

Contra tu API

Una llamada a un web service propio o de un tercero, para cruzar o completar información en tiempo real.
Ese último punto no es un conector cerrado. Captika lleva un motor de scripting sobre .NET 10, en C# o VB.NET, que permite intervenir en cada evento del proceso: al abrir el lote, al leer un campo, antes de publicar. Es la diferencia entre un producto que hace lo que trae y uno al que le podés escribir la regla que tu operación necesita.
03
OCR e inteligencia artificial

El motor más barato primero. El caro, sólo si hace falta.

Casi todos los productos de captura te hacen elegir un motor de OCR y pagarlo en cada página. Captika encadena varios: intenta con el más económico, y sólo escala al siguiente cuando el anterior no devolvió nada.

Primero

Capa de texto del PDF

Si el PDF ya trae su texto original, se lee directamente. No hay OCR, no hay imagen que interpretar y no hay error de lectura posible.

costo 0 · instantáneo
si el campo ya tiene valor, el proceso corta acá
Si no

Tesseract 5, local

OCR sobre la máquina del cliente, con captura espacial de cada palabra y línea: permite validar visualmente de dónde salió cada dato.

sin costo por página
si el campo ya tiene valor, el proceso corta acá
Recién entonces

Amazon Textract

OCR e ICR en la nube para lo que el motor local no pudo: manuscrito, tablas, formularios y firmas.

se paga sólo lo que llega hasta acá

Google Vision, OpenAI, Gemini, Azure OpenAI y Bedrock se conectan del mismo modo, y en todos los casos corren con las credenciales del propio cliente: el consumo lo factura el proveedor de nube directamente, sin intermediación ni recargo de Vivatia.

Captika Recognition · Reglas de extracciónTemplate FACTURAS-QR-CAPATEXTO
Pantalla de reconocimiento de Captika con la cascada de reglas, el texto OCR crudo y el valor ya limpio
La cascada tal como se configura: cargar la capa de texto del PDF, y si el campo sigue vacío, Tesseract; y si sigue vacío, Textract. Abajo, el texto crudo a la izquierda y el valor ya limpio a la derecha. Deslizá la imagen para recorrerla.
04
Reconocimiento y limpieza

Entender qué documento es, antes de extraerle nada.

Un lote mezclado no tiene un solo tipo de documento. Captika identifica cada uno por seis criterios distintos, combinables, y recién entonces aplica las reglas de extracción de ese tipo.

Código de barras

El separador o la carátula declara qué viene a continuación.

Campos extraídos

El propio dato leído decide el tipo: si hay CAE, es una factura electrónica.

Huella de imagen

Orden de página, tamaño, peso y forma. Sirve para formularios impresos siempre iguales.

Similitud de texto

Se sube un documento de ejemplo y se fija un umbral: lo parecido se clasifica solo.

Bolsas de palabras

Conjuntos de términos por sección del documento. Es lo que más acorta el armado de un template.

OCR y reglas

Extracción más reglas encadenadas, como la cascada de la sección anterior.

Sobre el valor extraído corren después las reglas de limpieza. Las nativas resuelven, sin programar nada, lo que en la región se pide todos los días:

CUIT / CUIL / RUTfechascorreosnúmeros escritos en letrasmáscaras de datos

Cuando el documento no es estructurado —un acta, una carta, un reclamo— se puede ir más allá de la regla y pedirle a un modelo que lo interprete:

Entidades

Amazon Comprehend extrae nombres de personas, organizaciones, lugares, teléfonos y números de un texto corrido.

Frases clave

Detecta de qué trata el documento sin que nadie lo haya clasificado antes.

Sentimiento

Sobre correos de clientes o reclamos, para priorizar lo que conviene atender primero.

Objetos en imagen

Amazon Rekognition identifica qué hay en una foto: caras, vehículos, objetos.

Preguntas al modelo

OpenAI, Gemini, Azure OpenAI o Bedrock reciben un prompt sobre el texto ya extraído y devuelven el dato interpretado.

Y para los documentos que llegan con separador o carátula, la lectura de códigos cubre los formatos que se usan en digitalización masiva:

CODE128CODE39CODE25CODABAREAN13QRCODEDATAMATRIXPDF417PATCHCODES
05
Publicación

Seis destinos, en paralelo, en la misma corrida.

El documento sale como PDF o TIF multipágina, con la capa de texto generada en la captura. Los datos salen por separado, y cada destino se configura por su cuenta: no hay que elegir uno.

FileSystem

Nombre de archivo configurable y estructura de carpetas armada con los propios campos extraídos, más archivos de texto parametrizables.

Base de datos

Los datos capturados se escriben en SQL para que los explote el sistema de gestión o el tablero.

Portal Thuban

Alta de documentos nuevos o actualización de los existentes, con los campos ya mapeados.

SharePoint

Los campos de Captika que coincidan con los metadatos de la lista se actualizan solos.

Amazon S3

Publicación directa al bucket, con el nombre de archivo que definas.

FTP / SFTP

Transferencia segura hacia el sistema de un tercero, con metadatos adjuntos.

Antes de escribir, el sistema analiza si el PDF contiene firmas, para no modificar un documento firmado.

Dos modalidades

Una persona revisando, o nadie mirando.

Captika Desktop es la interfaz donde un operador valida lo que el sistema leyó. Captika Service es un servicio de Windows que hace lo mismo sin nadie adelante, procesando varios trabajos a la vez según una agenda. Se pueden usar juntos: lo dudoso va a revisión humana, el resto pasa de largo.

Capacidades por modalidad
CapacidadDesktopService
OCR local integrado (Tesseract)
OCR e ICR en la nube
Motor de scripting C# / .NET
Validaciones contra base de datos o API
Logs de auditoría detallados
Perfiles de usuario y roles
Actualización automática de templates
Interfaz visual de revisión y correcciónNo
Escalabilidad horizontal (multiinstancia)No
Ejecución continua sin intervenciónNo

Los trabajos fallidos se redirigen automáticamente a una carpeta de revisión manual, y cada evento queda en el log. Un lote que no se pudo procesar no se pierde: se aparta.

Ediciones

Una edición para probarlo, una para trabajar, una para no mirar.

Free no es un plan de entrada: es una evaluación con tope diario, para que veas cómo lee tus propios documentos antes de decidir nada. El trabajo de todos los días se hace con Professional — y se paga una sola vez, no por mes.

Free Edition

Gratis
para evaluar
tope de 100 páginas por día

Sirve para una cosa concreta: pasarle tus documentos y ver qué extrae sin que nadie le explique nada.

  • Hasta 100 páginas por día
  • Hasta 3 trabajos de captura
  • OCR y reconocimiento incluidos
  • Requiere acceso a Thuban Cloud
Descargar y probar
Más elegida

Professional

USD 515
Pago único · por puesto
sin tope de páginas

La edición de trabajo: un puesto de captura y escaneo sin límites, con todo lo que la página describe arriba.

  • Captura y escaneo sin límites
  • Todas las fuentes y destinos
  • OCR, IA y scripting .NET 10
  • Validación visual y control de calidad
¡Comprar!

Server

Consultar precio
Licencia o suscripción · por servidor
procesamiento continuo

Cuando el volumen dejó de caber en una persona: corre como servicio, sin nadie adelante.

  • Procesamiento masivo automático 24/7
  • Multithreading y agenda de tareas
  • Todas las fuentes y destinos
  • Gestión de errores y trazabilidad
Solicitar cotización

El pago de Professional es por única vez y por puesto: no hay abono mensual ni renovación obligatoria.

Empezá a digitalizar hoy

Descargá gratis la Free Edition, adquirí Professional o pedí una cotización de Server.