Gestión inteligente de documentos con procesamiento OCR asíncrono y búsqueda avanzada.
- API REST
- Procesamiento asíncrono
- Motor OCR
- Gestión documental
- Responsive
- JWT
- PostgreSQL

Archivos ilegibles, tiempo perdido y datos ocultos
La organización acumulaba cientos de documentos digitales y escaneados sin una estructura clara. Los PDF escaneados eran tratados como simples imágenes, así que buscar texto dentro de ellos era imposible. No existía un repositorio unificado, los metadatos se perdían por el camino y dar con una factura o un contrato concreto costaba horas de revisión manual.

PaperBox digitaliza y centraliza los archivos en una plataforma de gestión documental automatizada. El backend en Django recibe los archivos y delega el trabajo pesado a procesos asíncronos con Celery y Redis. El motor OCR (Tesseract / OCRmyPDF) convierte los documentos escaneados en texto indexable, guarda los metadatos en PostgreSQL y expone una API segura que consume una interfaz en Angular. La autenticación con JWT mantiene el acceso privado y controlado.
Cada módulo, explicado

Acceso al sistema
- Qué problema resuelve
- Hacía falta un punto de entrada claro y rápido para empezar a trabajar sin perderse entre menús.
- Qué hace
- Pantalla de acceso con la misma experiencia en escritorio, tablet y celular, que lleva a cada usuario directo a su área de trabajo.
- Beneficio
- Curva de aprendizaje mínima: cualquiera sabe por dónde empezar desde el primer segundo, en el dispositivo que tenga a mano.

Panel de control
- Qué problema resuelve
- No había visibilidad sobre el volumen de información, el espacio ocupado ni el estado de los documentos en proceso.
- Qué hace
- Panel central con total de documentos, número de carpetas, almacenamiento usado, subidas recientes y estado de las tareas OCR en segundo plano. Incluye búsqueda rápida con Ctrl + K y sincronización con el disco.
- Beneficio
- El administrador entiende el uso del sistema y el avance de la digitalización en una sola pantalla.

Explorador de documentos
- Qué problema resuelve
- Navegar entre carpetas locales y correos era un caos sin estructura, y el contenido de los PDF escaneados era invisible para cualquier buscador.
- Qué hace
- Explorador en árbol con arrastrar y soltar, validación de PDF, metadatos por documento, varias vistas (lista, cuadrícula, tabla) y búsqueda de texto completo dentro del contenido gracias al OCR.
- Beneficio
- Encuentra una palabra dentro de un PDF escaneado igual que la buscarías en un documento de texto.

Panel de administración
- Qué problema resuelve
- Los archivos confidenciales quedaban al alcance de todo el personal por falta de un control de acceso fino.
- Qué hace
- Gestión de usuarios con roles y permisos para definir quién puede ver, subir o eliminar documentos, más una pestaña de auditoría con el historial de acciones.
- Beneficio
- Solo el personal autorizado llega a la documentación sensible, y cada acción queda registrada.

Guía integrada
- Qué problema resuelve
- Soporte recibía las mismas dudas una y otra vez: cómo subir archivos, cómo usar los filtros de búsqueda.
- Qué hace
- Manual interactivo embebido en la propia plataforma, con secciones de gestión de documentos, búsqueda y vistas, y estadísticas.
- Beneficio
- Los usuarios resuelven sus dudas solos, sin escribirle al área de sistemas por cada consulta.

Modo oscuro
- Qué problema resuelve
- Quienes pasan horas leyendo documentos frente a la pantalla terminaban la jornada con fatiga visual.
- Qué hace
- Soporte nativo de tema oscuro en toda la interfaz, ajustando el contraste sin sacrificar legibilidad.
- Beneficio
- Jornadas largas de revisión documental mucho más llevaderas para la vista.
Cada decisión técnica responde a un requisito real del proyecto, no a una moda.
Cada capacidad técnica se traduce en un problema operativo menos.
Motor OCR automático
Los PDF escaneados se vuelven legibles para la máquina: el texto se extrae sin intervención humana.
Procesamiento asíncrono
Subir documentos en masa no bloquea la pantalla: Celery y Redis hacen el trabajo pesado en segundo plano.
Búsqueda inteligente
Encuentra un documento por palabras que están dentro de la imagen del PDF, no solo en el nombre del archivo.
Roles y permisos
Control estricto de quién ve, sube y elimina cada documento.
Organización en árbol
Estructura de carpetas jerárquica que refleja la organización real de la empresa.
Responsive
Consulta o sube documentos desde el escritorio de la oficina o desde el celular en terreno.
Modo oscuro
Interfaz amable con la vista para largas jornadas de revisión.
Seguridad
Autenticación con tokens firmados (JWT) y control de sesiones.
Trazabilidad
Registro de auditoría con el historial de acciones sobre los documentos.
Escalabilidad
Arquitectura en contenedores, lista para crecer en volumen de archivos sin perder rendimiento.
Cliente / Servidor
Arquitectura
6+
Módulos desarrollados
Automática
Extracción OCR
Segura (JWT)
Autenticación
100% Responsive
Diseño
Soporte nativo
Modo oscuro
Desarrollo plataformas empresariales personalizadas con integración de APIs, automatización de procesos y dashboards modernos.