Tutorial para usar un OCR Open Source: convierte PDFs e imágenes en datos usando Docling
Liorant - IA para empresas
0:00 / 0:00
Tutorial para usar un OCR Open Source: convierte PDFs e imágenes en datos usando Docling
626 просмотров · 2 месяца назад
Liorant - IA para empresas
306 подписчиков
626 просмотров · 2 месяца назад
En este tutorial vemos cómo usar OCR con Docling para convertir documentos como PDFs, imágenes, contratos, facturas o reportes en contenido estructurado que luego puede usarse en flujos de IA.
Usaremos Google Colab para procesar documentos, extraer texto, generar Markdown, detectar tablas y preparar el contenido para sistemas como RAG, asistentes internos, automatizaciones o análisis documental.
También explico algo clave: OCR no es solo “leer texto”. Es el primer paso para convertir documentos desordenados en conocimiento reutilizable para sistemas de IA.
00:00 Intro
00:47 Introducción a Docling: funcionalidades, componentes y usos avanzados
03:33 Los PDFs escaneados y con tablas que vamos a analizar
04:57 Ejercicio 1: Uso de OCR paso a paso para extraer textos de PDFs escaneados
09:34 Texto generado y estructurado con OCR
10:27 Ejercicio 2: Uso de OCR paso a paso para extraer textos y estructurar tablas
12:34 Datos estructurados y extraidos del PDF utilizando OCR
13:31 Ejercicio 3: Cómo extraer tablas de un PDF y convertirlas a formato CSV
Para documentos sensibles, recuerda: no uses información real de clientes en demos públicas. Lo recomendable es ejecutar estos flujos localmente o en un entorno privado y controlado.
En Liorant ayudamos a empresas a convertir documentos, procesos y conocimiento interno en sistemas de IA prácticos, seguros y escalables.
¿Quieres implementar sistemas similares en tu empresa? Escríbenos a info@liorant.com
Documentación de Docling https://docling-project.github.io/doc...
Repo de Docling https://github.com/docling-project/do...
Enlace al Notebook de Liorant con los ejercicios del vídeo https://colab.research.google.com/dri...