Case Study · Gestión Documental

Gestión inteligente de documentos con procesamiento OCR asíncrono y búsqueda avanzada.

  • API REST
  • Procesamiento asíncrono
  • Motor OCR
  • Gestión documental
  • Responsive
  • JWT
  • PostgreSQL
paperbox / panel
PaperBox en escritorio, tablet y celular
El problema

Archivos ilegibles, tiempo perdido y datos ocultos

La organización acumulaba cientos de documentos digitales y escaneados sin una estructura clara. Los PDF escaneados eran tratados como simples imágenes, así que buscar texto dentro de ellos era imposible. No existía un repositorio unificado, los metadatos se perdían por el camino y dar con una factura o un contrato concreto costaba horas de revisión manual.

Volumen de carpetas y documentos antes de poder buscarlos
La solución

PaperBox digitaliza y centraliza los archivos en una plataforma de gestión documental automatizada. El backend en Django recibe los archivos y delega el trabajo pesado a procesos asíncronos con Celery y Redis. El motor OCR (Tesseract / OCRmyPDF) convierte los documentos escaneados en texto indexable, guarda los metadatos en PostgreSQL y expone una API segura que consume una interfaz en Angular. La autenticación con JWT mantiene el acceso privado y controlado.

Procesamiento OCR (Celery + Tesseract)
Motor de cola (Redis)
Backend (Django + DRF)
Extracción de metadatos y validación
Autenticación JWT / Permisos
PostgreSQL
API REST interna
Frontend Angular + TypeScript
Usuarios / Administradores
Recorrido por el producto

Cada módulo, explicado

Pantalla de acceso en escritorio, tablet y celular
Módulo 01

Acceso al sistema

Qué problema resuelve
Hacía falta un punto de entrada claro y rápido para empezar a trabajar sin perderse entre menús.
Qué hace
Pantalla de acceso con la misma experiencia en escritorio, tablet y celular, que lleva a cada usuario directo a su área de trabajo.
Beneficio
Curva de aprendizaje mínima: cualquiera sabe por dónde empezar desde el primer segundo, en el dispositivo que tenga a mano.
Panel con métricas de almacenamiento y estado del OCR
Módulo 02

Panel de control

Qué problema resuelve
No había visibilidad sobre el volumen de información, el espacio ocupado ni el estado de los documentos en proceso.
Qué hace
Panel central con total de documentos, número de carpetas, almacenamiento usado, subidas recientes y estado de las tareas OCR en segundo plano. Incluye búsqueda rápida con Ctrl + K y sincronización con el disco.
Beneficio
El administrador entiende el uso del sistema y el avance de la digitalización en una sola pantalla.
Árbol de carpetas con búsqueda por contenido
Módulo 03

Explorador de documentos

Qué problema resuelve
Navegar entre carpetas locales y correos era un caos sin estructura, y el contenido de los PDF escaneados era invisible para cualquier buscador.
Qué hace
Explorador en árbol con arrastrar y soltar, validación de PDF, metadatos por documento, varias vistas (lista, cuadrícula, tabla) y búsqueda de texto completo dentro del contenido gracias al OCR.
Beneficio
Encuentra una palabra dentro de un PDF escaneado igual que la buscarías en un documento de texto.
Gestión de usuarios, roles y auditoría
Módulo 04

Panel de administración

Qué problema resuelve
Los archivos confidenciales quedaban al alcance de todo el personal por falta de un control de acceso fino.
Qué hace
Gestión de usuarios con roles y permisos para definir quién puede ver, subir o eliminar documentos, más una pestaña de auditoría con el historial de acciones.
Beneficio
Solo el personal autorizado llega a la documentación sensible, y cada acción queda registrada.
Manual de uso embebido en la plataforma
Módulo 05

Guía integrada

Qué problema resuelve
Soporte recibía las mismas dudas una y otra vez: cómo subir archivos, cómo usar los filtros de búsqueda.
Qué hace
Manual interactivo embebido en la propia plataforma, con secciones de gestión de documentos, búsqueda y vistas, y estadísticas.
Beneficio
Los usuarios resuelven sus dudas solos, sin escribirle al área de sistemas por cada consulta.
La misma interfaz en tema oscuro
Módulo 06

Modo oscuro

Qué problema resuelve
Quienes pasan horas leyendo documentos frente a la pantalla terminaban la jornada con fatiga visual.
Qué hace
Soporte nativo de tema oscuro en toda la interfaz, ajustando el contraste sin sacrificar legibilidad.
Beneficio
Jornadas largas de revisión documental mucho más llevaderas para la vista.
Stack tecnológico

Cada decisión técnica responde a un requisito real del proyecto, no a una moda.

Angular
TypeScript
Django / DRF
Python
Celery
Redis
PostgreSQL
Tesseract OCR
Tailwind CSS
JWT
Beneficios

Cada capacidad técnica se traduce en un problema operativo menos.

Motor OCR automático

Los PDF escaneados se vuelven legibles para la máquina: el texto se extrae sin intervención humana.

Procesamiento asíncrono

Subir documentos en masa no bloquea la pantalla: Celery y Redis hacen el trabajo pesado en segundo plano.

Búsqueda inteligente

Encuentra un documento por palabras que están dentro de la imagen del PDF, no solo en el nombre del archivo.

Roles y permisos

Control estricto de quién ve, sube y elimina cada documento.

Organización en árbol

Estructura de carpetas jerárquica que refleja la organización real de la empresa.

Responsive

Consulta o sube documentos desde el escritorio de la oficina o desde el celular en terreno.

Modo oscuro

Interfaz amable con la vista para largas jornadas de revisión.

Seguridad

Autenticación con tokens firmados (JWT) y control de sesiones.

Trazabilidad

Registro de auditoría con el historial de acciones sobre los documentos.

Escalabilidad

Arquitectura en contenedores, lista para crecer en volumen de archivos sin perder rendimiento.

Resultados

Cliente / Servidor

Arquitectura

6+

Módulos desarrollados

Automática

Extracción OCR

Segura (JWT)

Autenticación

100% Responsive

Diseño

Soporte nativo

Modo oscuro

PaperBox

Desarrollo plataformas empresariales personalizadas con integración de APIs, automatización de procesos y dashboards modernos.