Saltar al pie de página
HERRAMIENTAS OCR

OCR de Power Automate (Tutorial para Desarrolladores)

El Reconocimiento Óptico de Caracteres (OCR) es la tecnología que escanea texto de imágenes, documentos escaneados y PDFs para transformarlo en texto legible por máquina. OCR permite a las computadoras identificar varios formatos: libros, recibos, formularios y fotografías que pueden ser digitalizados y automatizados para la extracción de datos de PDF. Analiza los caracteres en una imagen y sus patrones, luego los corresponde a texto. Esta tecnología de Reconocimiento Óptico de Caracteres se emplea en aplicaciones de digitalización de documentos, extracción automática de datos de PDF y entrada, procesamiento de facturas, y para hacer que los PDFs escaneados sean buscables.

Los OCR han mejorado drásticamente y pueden reconocer y leer diferentes idiomas, que hoy en día son complejos en la comprensión de diseños, como las tablas y columnas. El software de capacidades avanzadas de OCR también utiliza técnicas de preprocesamiento para imágenes. Estas incluyen la eliminación de ruido y el ajuste de contraste, mejorando la precisión del software OCR al leer imágenes de baja calidad. Tres de las herramientas OCR más populares son el motor Tesseract OCR, Power Automate y IronOCR, con alta precisión y flexibilidad. Los OCR se han convertido en herramientas indispensables para empresas, investigadores y desarrolladores para externalizar la gestión de la documentación y el reconocimiento de texto.

¿Qué es Microsoft Power Automate OCR?

Reconocimiento Óptico de Caracteres por Microsoft Power Automate: Usando esta función, las empresas pueden automatizar la extracción de texto de imágenes, documentos escaneados y PDFs en formatos fácilmente editables y legibles por máquina. Siendo parte de la plataforma Microsoft Power, Power Automate desktop y online proporciona al usuario la capacidad de crear flujos sin necesidad de habilidades de codificación. Pueden automatizar la tediosa entrada de datos, procesar facturas, y digitalizar documentos con la integración de OCR en los flujos de trabajo.

Esto ahorra tiempo y minimiza errores. Es de hecho una potente herramienta de búsqueda que puede soportar muchos formatos y idiomas diferentes en la función OCR de Power Automate. Construido usando AI Builder, soporta el uso de reconocimiento de texto en múltiples industrias. Se integra perfectamente con otros servicios de Microsoft, incluyendo Excel, SharePoint y OneDrive, permitiendo la automatización de extremo a extremo desde escanear el documento hasta almacenarlo o incluso compartirlo. Esto ayuda a las organizaciones a aumentar la eficiencia, agilizar la gestión de documentos y mejorar la precisión operativa en sus actividades.

Beneficios de implementar OCR en Power Automate

Implementar OCR en Power Automate tiene las siguientes ventajas:

Ahorrar Tiempo y Esfuerzo: La automatización de la extracción de texto de documentos ahorra una cantidad significativa de tiempo y esfuerzo que de otro modo se usaría en la entrada manual de datos.

Económico: Amigable para el usuario y accesible, eliminando la necesidad de soluciones de software personalizadas y costosas.

Integración: Microsoft Power Automate ofrece integración perfecta con otros servicios de Microsoft 365 como SharePoint, OneDrive, e incluso Excel.

Escalabilidad: Puede manejar miles de documentos a la vez, lo que lo hace adecuado para grandes empresas.

Reducción de Errores: La automatización de los procesos de entrada de datos minimiza la probabilidad de error humano.

Cómo trabajar con OCR en Power Automate

Power Automate soporta la funcionalidad OCR a través de varias conexiones diferentes, incluyendo AI Builder y OneDrive. Aquí tienes una guía paso a paso sobre cómo crear un flujo habilitado con OCR usando Power Automate online o desktop:

1. Configurar Power Automate

Para empezar, inicia sesión en tu cuenta de Power Automate o regístrate si no tienes una. Power Automate es parte de Microsoft 365, lo que significa que ya tienes acceso si estás usando Office 365 o Dynamics 365.

2. Crea un nuevo flujo

Abre la pestaña Crear y haz clic en Flujo Instantáneo para crear un nuevo flujo que se pueda iniciar manualmente.

Nombra tu flujo. Por ejemplo, nomínalo "Antes de la aprobación" y selecciona el siguiente desencadenador: Cuando se crea un archivo en una carpeta (SharePoint o OneDrive) o Iniciar un flujo manualmente.

Se crea un nuevo flujo de automatización de Power, similar al que se muestra a continuación.

Power Automate OCR (Tutorial para desarrolladores): Figura 5 - Nuevo flujo de automatización

3. Subir un archivo a OneDrive o SharePoint

Agrega una acción para subir tu documento (imagen o PDF) a OneDrive para Empresas o SharePoint. Esta acción desencadenará el proceso de OCR para extraer datos. Para esta demostración, estamos usando una biblioteca de Documentos de SharePoint.

Power Automate OCR (Tutorial para desarrolladores): Figura 6 - Subir archivo

4. Utilice la acción OCR del generador de IA

Utiliza AI Builder para desarrollar la acción "Extraer texto de imágenes". AI Builder es una característica profundamente integrada de Machine Learning en Power Automate y tiene modelos OCR preentrenados que permiten a los usuarios identificar fácilmente texto de imágenes o PDFs.

Power Automate OCR (Tutorial para desarrolladores): Figura 7 - AI Builder

Selecciona el archivo de imagen del cual extraer texto.

Power Automate OCR (Tutorial para desarrolladores): Figura 8 - Seleccionar imagen

5. Procesamiento de datos extraídos

Una vez que el texto es extraído por OCR, puede ser procesado más. Por ejemplo:

Almacenar el texto extraído en un formato Excel: Usa la acción "Agregar una fila" para insertar el texto extraído en un archivo Excel.

Pasa el texto por Correo Electrónico: Usa la acción "Enviar un correo" para reenviar el texto extraído a destinatarios especificados.

Almacenar en la Base de Datos: Usa Conectores para enviar datos al servidor SQL, listas de SharePoint u otras bases de datos para su almacenamiento.

¿Qué es IronOCR?

IronOCR es una poderosa biblioteca OCR .NET que te permite extraer texto con OCR de manera precisa desde imágenes, PDFs y escaneos. Destaca donde otras bibliotecas pueden tener problemas con el reconocimiento de texto debido a la baja calidad de las imágenes o imágenes con ruido y soporta más de 125 idiomas, haciéndolo perfecto para casos de uso multilingües. IronOCR incluye funcionalidades avanzadas como detección automática de idioma, preprocesamiento de imágenes, eliminación de ruido, corrección de inclinación, y conversión de documentos a PDFs buscables mientras preserva el diseño original.

Power Automate OCR (Tutorial para desarrolladores): Figura 9 - IronOCR

El producto puede ser incorporado fácilmente a través de APIs de proyectos .NET simples, permitiendo a los desarrolladores implementar OCR en aplicaciones que desarrollan. La biblioteca es especialmente útil para la digitalización de documentos, flujos de trabajo automatizados para entrada de datos, y tareas de extracción de texto con alta precisión y escalabilidad para aplicaciones a nivel empresarial. Su facilidad de uso y potentes capacidades de OCR son sus puntos fuertes.

Características de IronOCR

  • Precisión sobresaliente en la extracción de texto, incluso de imágenes de baja resolución y documentos escaneados con ruido.
  • Soporta más de 125 idiomas, con detección automática de idiomas para su uso en entornos lingüísticos variados.
  • Ofrece herramientas para preprocesamiento de imágenes, como reducción de ruido, corrección de inclinación, mejora de contraste y enfoque, para mejorar el rendimiento en imágenes imperfectas.
  • Crea PDFs buscables de texto completo, convirtiendo documentos escaneados o imágenes en PDFs totalmente buscables con el diseño original.
  • Preserva el diseño y el formato, manteniendo la estructura, fuentes y formateado de los documentos fuente, esenciales para documentos complejos con tablas y columnas.
  • Procesamiento por Lotes: Permite el procesamiento por lotes de múltiples imágenes o documentos en una operación, soportando el manejo de documentos en gran volumen.
  • Fácil integración con .NET: Soporta una API simple para una fácil integración con aplicaciones .NET, permitiendo a los desarrolladores implementar OCR sin esfuerzo significativo.

Código de Ejemplo para realizar OCR

using IronOcr;

class Program
{
    static void Main(string[] args)
    {
        // Initialize Iron Tesseract OCR engine
        var Ocr = new IronTesseract();

        // Set language
        Ocr.Language = OcrLanguage.English;

        // Path to the image file
        var inputFile = @"path\to\your\image.png";

        // Read the image and perform OCR
        using (var Input = new OcrInput(inputFile))
        {
            // Perform OCR
            var Result = Ocr.Read(Input);

            // Display the extracted text in the console
            Console.WriteLine("Extracted Text:");
            Console.WriteLine(Result.Text);
        }
    }
}
using IronOcr;

class Program
{
    static void Main(string[] args)
    {
        // Initialize Iron Tesseract OCR engine
        var Ocr = new IronTesseract();

        // Set language
        Ocr.Language = OcrLanguage.English;

        // Path to the image file
        var inputFile = @"path\to\your\image.png";

        // Read the image and perform OCR
        using (var Input = new OcrInput(inputFile))
        {
            // Perform OCR
            var Result = Ocr.Read(Input);

            // Display the extracted text in the console
            Console.WriteLine("Extracted Text:");
            Console.WriteLine(Result.Text);
        }
    }
}
Imports IronOcr

Friend Class Program
	Shared Sub Main(ByVal args() As String)
		' Initialize Iron Tesseract OCR engine
		Dim Ocr = New IronTesseract()

		' Set language
		Ocr.Language = OcrLanguage.English

		' Path to the image file
		Dim inputFile = "path\to\your\image.png"

		' Read the image and perform OCR
		Using Input = New OcrInput(inputFile)
			' Perform OCR
			Dim Result = Ocr.Read(Input)

			' Display the extracted text in the console
			Console.WriteLine("Extracted Text:")
			Console.WriteLine(Result.Text)
		End Using
	End Sub
End Class
$vbLabelText   $csharpLabel

Conclusión

Aunque tanto IronOCR como Power Automate OCR son altamente potentes para el reconocimiento de texto, IronOCR es considerablemente más robusto y versátil en su solución para cualquier desarrollador o empresa que necesite serias capacidades OCR más allá de los casos simples soportados por Power Automate OCR. El motor OCR de Power Automate está diseñado para flujos de trabajo simples y puede requerir una suscripción adicional.

En contraste, IronOCR destaca al entregar resultados de alta calidad, incluso al tratar con imágenes de entrada de baja calidad. Soporta más de 125 idiomas con un formateado y un diseño bien preservados. Sus capacidades para el procesamiento de documentos complejos y operaciones de grandes lotes están bien soportadas con opciones avanzadas de preprocesamiento de imágenes. Es altamente personalizable en aplicaciones .NET.

Power Automate OCR es suficiente para automatizaciones menores o integraciones estrictamente dentro del ecosistema de Microsoft, mientras que IronOCR sobresale con máxima precisión y control, soportando características como la creación de PDFs buscables que acomodan múltiples formatos.

Para organizaciones que buscan una solución OCR personalizada y crítica de poder sin restricciones de plataforma, IronOCR es recomendado. Iron Software ofrece una variedad de opciones de biblioteca para los desarrolladores. Consulta la página de la suite de bibliotecas para más detalles.

Kannaopat Udonpant
Ingeniero de Software
Antes de convertirse en Ingeniero de Software, Kannapat completó un doctorado en Recursos Ambientales de la Universidad de Hokkaido en Japón. Mientras perseguía su grado, Kannapat también se convirtió en miembro del Laboratorio de Robótica de Vehículos, que es parte del Departamento de Ingeniería ...
Leer más

Equipo de soporte de Iron

Estamos disponibles online las 24 horas, 5 días a la semana.
Chat
Email
Llámame