← Volver al catálogo
Datos y análisisAutomatizaciónIntermedioGratis

LiteParse — Parseo Local de Documentos con OCR y Bounding Boxes

Extrae texto estructurado con coordenadas espaciales de PDFs, archivos Office e imágenes de forma completamente local, sin APIs en la nube. Ideal para pipelines RAG con preservación de layout, OCR de documentos escaneados y captura de páginas para agentes multimodales.

Descargar skill (.zip)

Descarga abierta · sin registro · para Python, Node.js, CLI

// resultado_de_ejemplo
Abrir en una pestaña nueva ↗

// qué_hace

Parsea PDFs, documentos Office e imágenes de forma local extrayendo texto con bounding boxes, OCR integrado y capturas de página en PNG.

// cómo_lo_hace

Usa un núcleo en Rust con bindings Python/Node y Tesseract embebido; ofrece CLI `lit` y API programática para parseo en lote, páginas concretas y búsqueda de frases con coordenadas.

// ejemplo_de_uso

Cuando necesitas extraer texto o tablas de documentos sin enviarlos a la nube por privacidad o coste. Ej.: parsear facturas PDF en lote y obtener las coordenadas exactas de cada campo para validación automática.

// plataformas

PythonNode.jsCLI
Categoría
Datos y análisis
Tipo
Automatización
Nivel
Intermedio
Licencia
MIT
Seguridad
seguro · riesgo bajo
Versión
1.0.0

// opiniones_de_la_comunidad

Opiniones

Cargando opiniones…

// pase_cultiva_ia

Llévate todo el arsenal con el Pase

Todas las skills, prompts y automatizaciones del catálogo en un único archivo, listas para usar: un pago, acceso de por vida y las novedades que añadamos. Sin suscripción.

Pago único · IVA incluido · pago seguro con Stripe.

Acceso inmediato · si no es lo que esperabas, te devolvemos los 10 €.