Captura desde donde esté el papel
Escáner TWAIN, una casilla de correo, una carpeta de red, SharePoint, Thuban o un FTP. Seis fuentes distintas que terminan en el mismo lote.
Digitalizar no es escanear: un PDF que nadie puede buscar sigue siendo un papel, solo que ocupa disco en vez de estante. Acá el documento entra, se lee, se le extraen los datos que importan y sale publicado donde tu gente lo va a ir a buscar.
Esta solución se implementa con nuestro equipo sobre Thuban: relevamiento, configuración y puesta en marcha. No se contrata online.
¿Buscás algo que puedas activar hoy? Mirá Captika SoftwareSeis piezas que convierten una pila de documentos en información que se puede buscar y usar.
Escáner TWAIN, una casilla de correo, una carpeta de red, SharePoint, Thuban o un FTP. Seis fuentes distintas que terminan en el mismo lote.
Códigos de barras, patch codes o páginas en blanco marcan dónde termina un documento y empieza el siguiente. Nadie corta el lote a mano.
Primero la capa de texto que el PDF ya trae, que no cuesta nada; después Tesseract; y solo si hace falta, Textract. Se paga el reconocimiento caro únicamente donde hizo falta.
Los campos que importan salen del documento y quedan como metadatos: número, fecha, identificación fiscal, importe. Con reglas de limpieza para lo que el OCR suele leer mal.
El dato extraído se contrasta contra tus propias bases o contra una lista, y el lote no avanza si algo no cierra.
Filesystem, SQL, Thuban, SharePoint, S3 o FTP. El documento queda buscable por sus datos y por lo que dice adentro.
Las imágenes entran desde cualquiera de las seis fuentes.
El lote se corta en documentos por marcas, no a ojo.
El OCR deja el texto y los campos que importan.
Se contrastan los datos antes de dar el lote por bueno.
El documento sale al repositorio, ya buscable.
El papel se consulta desde la pantalla, así que la caja puede irse a un depósito o dejar de existir, según lo que exija la retención.
No por el nombre que alguien le puso al archivo. El OCR deja adentro el texto completo, y los campos extraídos permiten filtrar.
Lo que el documento ya dice no se vuelve a tipear en el sistema de destino: se publica junto con la imagen.
Un pico de documentos se absorbe agregando lotes, no personas. Y el proceso se puede dejar corriendo como servicio.
Captika hace la captura, el reconocimiento y la publicación; Thuban es uno de los destinos posibles, el que además gobierna permisos, versiones y auditoría sobre lo publicado.
Te mostramos qué extrae de un lote tuyo, con los tipos de documento que manejás todos los días, sin compromiso.
Solicitar una demo