Перейти к содержимому

Tutorial para usar un OCR Open Source: convierte PDFs e imágenes en datos usando Docling

Liorant - IA para empresas

0:00 / 0:00

Tutorial para usar un OCR Open Source: convierte PDFs e imágenes en datos usando Docling

626 просмотров · 2 месяца назад
Liorant - IA para empresas
306 подписчиков
626 просмотров · 2 месяца назад
En este tutorial vemos cómo usar OCR con Docling para convertir documentos como PDFs, imágenes, contratos, facturas o reportes en contenido estructurado que luego puede usarse en flujos de IA. Usaremos Google Colab para procesar documentos, extraer texto, generar Markdown, detectar tablas y preparar el contenido para sistemas como RAG, asistentes internos, automatizaciones o análisis documental. También explico algo clave: OCR no es solo “leer texto”. Es el primer paso para convertir documentos desordenados en conocimiento reutilizable para sistemas de IA. 00:00 Intro 00:47 Introducción a Docling: funcionalidades, componentes y usos avanzados 03:33 Los PDFs escaneados y con tablas que vamos a analizar 04:57 Ejercicio 1: Uso de OCR paso a paso para extraer textos de PDFs escaneados 09:34 Texto generado y estructurado con OCR 10:27 Ejercicio 2: Uso de OCR paso a paso para extraer textos y estructurar tablas 12:34 Datos estructurados y extraidos del PDF utilizando OCR 13:31 Ejercicio 3: Cómo extraer tablas de un PDF y convertirlas a formato CSV Para documentos sensibles, recuerda: no uses información real de clientes en demos públicas. Lo recomendable es ejecutar estos flujos localmente o en un entorno privado y controlado. En Liorant ayudamos a empresas a convertir documentos, procesos y conocimiento interno en sistemas de IA prácticos, seguros y escalables. ¿Quieres implementar sistemas similares en tu empresa? Escríbenos a info@liorant.com Documentación de Docling https://docling-project.github.io/doc... Repo de Docling https://github.com/docling-project/do... Enlace al Notebook de Liorant con los ejercicios del vídeo https://colab.research.google.com/dri...