← Volver al sitio Caso de estudio · Automatización

Extractor de Novedades
Cartelerías

De varios minutos revisando producto por producto, a segundos: automatización para un importante supermercado en Chile.

El problema

El "Listado de Novedades" es un PDF con todos los cambios de precio del período, mezclando productos de secciones muy distintas — no todos son ofertas reales. Además, pueden llegar varias versiones del mismo listado en un solo día, cada una con nuevos cambios.

"Había que revisar producto por producto a mano, cada vez que llegaba una versión nueva, y traspasar las rebajas reales al Excel del macro de impresión."

La solución

Lee el PDF, extrae solo el texto relevante de cada producto y filtra automáticamente las rebajas reales — sin subir el documento a ningún servidor. Procesa cada nueva versión del listado en segundos.

Python Lenguaje base del proyecto: recorre el texto del PDF y aplica la lógica de detección de productos y filtrado de ofertas. Streamlit Convierte el script de Python en una app web con interfaz: subir el PDF, ver la tabla de resultados y descargar el Excel. PyMuPDF Librería que abre el PDF y extrae su texto línea por línea, para reconocer el patrón de cada producto. Pandas Organiza los productos extraídos en una tabla, limpia los precios y filtra solo las rebajas reales.
📤
Subir PDF
🔎
Extraer texto
🎯
Detectar productos
Filtrar ofertas
📊
Excel
Demo en vivo disponible
Desarrollado por Cristian Esparza Torrealba · Ingeniería en Información y Control de Gestión, UCSC · cesparza@iicg.ucsc.cl