IRONSOFTWAREHOME

Cómo leer capturas de pantalla con IronOCR en C#

Curtis Chau
Curtis Chau
Updated: 4 de junio de 2026

El método de IronOCR ReadScreenshot extrae texto de capturas de pantalla de manera eficiente, manejando varios desafíos de dimensiones y ruido mientras admite formatos de archivo comunes, incluidos PNG, JPG y BMP.

Las capturas de pantalla son una forma rápida de compartir información y capturar datos vitales. Sin embargo, la extracción de texto de capturas de pantalla ha demostrado ser difícil debido a las dimensiones variables y al ruido. Esto hace que las capturas de pantalla sean un medio difícil para el OCR.

IronOCR resuelve este problema proporcionando métodos especializados como ReadScreenshot. Este método está optimizado para leer capturas de pantalla y extraer información de ellas, al tiempo que acepta formatos de archivo comunes. A diferencia de los métodos estándar de OCR, este método aplica optimizaciones específicas de preprocesamiento adaptadas al contenido de las capturas de pantalla, incluida la reducción automática del ruido y la mejora del contraste.

Para usar esta función, instala el paquete [IronOcr.Extension.AdvancedScan]. Esta extensión ofrece funciones avanzadas de visión por ordenador que mejoran la precisión del reconocimiento de texto en capturas de pantalla, en particular para elementos de interfaz de usuario, fuentes del sistema y texto con suavizado en aplicaciones modernas.

Inicio rápido: Leer texto de una captura de pantalla

Comienza en segundos utilizando el ReadScreenshot de IronOCR: carga tu captura de pantalla en un OcrInput, llama a ReadScreenShot y accede de inmediato al texto extraído, puntaje de confianza y regiones de texto a través del OcrPhotoResult. Es la forma más rápida de convertir imágenes en texto utilizable con una configuración mínima.

  1. 1Install IronOCR with NuGet Package Manager

    PM > Install-Package IronOcr

  2. 2Copie y ejecute este fragmento de código.

    OcrPhotoResult result = new IronTesseract().ReadScreenShot(new OcrInput().LoadImage("screenshot.png"));
    C#
  3. 3Despliegue para probar en su entorno real

    Comienza a usar IronOCR en tu proyecto hoy mismo con una prueba gratuita
    arrow pointer

Esta guía muestra cómo utilizar IronOCR para el reconocimiento de texto en capturas de pantalla, mostrando ejemplos y las propiedades del objeto resultante. Exploraremos escenarios avanzados como procesamiento de regiones específicas, manejo de contenido multilingüe y optimización del rendimiento para el procesamiento por lotes.

¿Cómo extraigo texto de capturas de pantalla usando ReadScreenshot?

Para leer una captura de pantalla en IronOCR, utiliza el método ReadScreenshot, que toma un OcrInput como parámetro. Este método está más optimizado para capturas de pantalla que su contraparte estándar Read de la biblioteca. La optimización incluye la detección automática de elementos de la interfaz de usuario, un mejor manejo de las fuentes con suavizado y un mejor reconocimiento de las fuentes del sistema en distintos sistemas operativos.

Por favor nota:
  • El método actualmente funciona para idiomas que incluyen inglés, chino, japonés, coreano y alfabetos con base latina.
  • Usar escaneo avanzado en .NET Framework requiere que el proyecto se ejecute en arquitectura x64.

)}]

¿Qué tipos de capturas de pantalla funcionan mejor?

A continuación, nuestra entrada para el ejemplo de código; demostramos la versatilidad de este método mezclando diferentes fuentes y tamaños de texto. El método ReadScreenshot se destaca en reconocer:

  • Fuentes de interfaz de usuario del sistema (Windows, macOS, Linux)
  • Texto suavizado de aplicaciones modernas
  • Mezcla de tamaños y estilos de fuente
  • Texto superpuesto sobre fondos complejos
  • Capturas de pantalla de la consola y del terminal
  • Contenido para navegadores con varias fuentes web

Para obtener resultados óptimos, haz capturas de pantalla con resolución nativa y sin compresión. El método admite varios formatos de imagen, pero el formato PNG es el que mejor conserva la claridad del texto gracias a su compresión sin pérdidas.

Página de inicio de la biblioteca OCR C# de IronOCR mostrando la compatibilidad de la plataforma y las características clave para el reconocimiento de texto

¿Cómo implemento el método ReadScreenshot?

using IronOcr;
using System;
using System.Linq;

// Instantiate OCR engine
var ocr = new IronTesseract();

using var inputScreenshot = new OcrInput();
inputScreenshot.LoadImage("screenshotOCR.png");

// Perform OCR
OcrPhotoResult result = ocr.ReadScreenShot(inputScreenshot);

// Output screenshot information
Console.WriteLine(result.Text);
Console.WriteLine(result.TextRegions.First().Region.X);
Console.WriteLine(result.TextRegions.Last().Region.Width);
Console.WriteLine(result.Confidence);

Para situaciones complejas, mejore el proceso de lectura de capturas de pantalla con un preprocesamiento adicional:

using IronOcr;
using System;

// Configure OCR engine with specific settings for screenshots
var ocr = new IronTesseract()
{
    // Set language for better accuracy with non-English content
    Language = OcrLanguage.English,
    // Configure for screen-resolution images
    Configuration = new TesseractConfiguration()
    {
        PageSegmentationMode = TesseractPageSegmentationMode.AutoOsd,
        // Enable whitelist for specific characters if needed
        WhiteListCharacters = null
    }
};

using var inputScreenshot = new OcrInput();
// Load screenshot with specific DPI setting for consistency
inputScreenshot.LoadImage("screenshotOCR.png");

// Apply preprocessing for better accuracy
inputScreenshot.DeNoise(); // Remove screenshot artifacts
inputScreenshot.Sharpen(); // Enhance text edges

// Perform OCR with error handling
try
{
    OcrPhotoResult result = ocr.ReadScreenShot(inputScreenshot);
    
    // Process results with confidence threshold
    if (result.Confidence > 0.8)
    {
        Console.WriteLine($"High confidence text extraction: {result.Text}");
    }
    else
    {
        Console.WriteLine("Low confidence - consider image preprocessing");
    }
}
catch (Exception ex)
{
    Console.WriteLine($"OCR Error: {ex.Message}");
}
C#

¿Qué propiedades devuelve OcrPhotoResult?

Depurador de Visual Studio mostrando detalles de la biblioteca IronOCR con versión 2024.9 y puntaje de precisión 0.937

El resultado de la consola muestra la extracción de todas las instancias de texto de la captura de pantalla. Exploremos las propiedades de OcrPhotoResult y cómo aprovecharlas eficazmente:

  • Text: El texto extraído de la entrada OCR. Esta propiedad contiene todo el texto reconocido como una única cadena, conservando el diseño original con saltos de línea y espaciado.
  • Confidence: Una propiedad doble que indica la confianza de precisión estadística en una escala de 0 a 1, donde 1 representa la mayor confianza. Utilízalo para implementar el control de calidad en tu aplicación.
  • TextRegion: Un arreglo de objetos TextRegion que contiene propiedades que devuelven áreas donde se encuentra texto en la captura de pantalla. Por defecto, todo TextRegion es una clase derivada Rectangle de modelos de IronOCR. Incluye coordenadas x y y más height y width del rectángulo.

Trabajar con TextRegions te permite:

  • Extraer texto de áreas específicas de capturas de pantalla
  • Identificar las ubicaciones de los elementos de la interfaz de usuario
  • Crear superposiciones en las que se pueda hacer clic en función de la posición del texto
  • Implementar procesamiento de OCR específico de la región

He aquí un ejemplo de procesamiento de regiones de texto individuales:

using IronOcr;
using System;
using System.Linq;

var ocr = new IronTesseract();
using var input = new OcrInput();
input.LoadImage("screenshot.png");

OcrPhotoResult result = ocr.ReadScreenShot(input);

// Process each text region individually
foreach (var region in result.TextRegions)
{
    Console.WriteLine($"Text: {region.TextInRegion}");
    Console.WriteLine($"Location: X={region.Region.X}, Y={region.Region.Y}");
    Console.WriteLine($"Size: {region.Region.Width}x{region.Region.Height}");
    Console.WriteLine($"Confidence: {region.RegionConf:P2}");
    Console.WriteLine("---");
}

// Find specific UI elements by text content
var buttonRegion = result.TextRegions
    .FirstOrDefault(r => r.TextInRegion.Contains("Submit", StringComparison.OrdinalIgnoreCase));

if (buttonRegion != null)
{
    Console.WriteLine($"Found button at: {buttonRegion.Region.X}, {buttonRegion.Region.Y}");
}
C#

Técnicas avanzadas de procesamiento de capturas de pantalla

Capturas de pantalla en varios idiomas

Cuando se trabaja con capturas de pantalla que contienen varios idiomas, IronOCR proporciona un sólido soporte multilingüe. Esto es útil para aplicaciones internacionales o capturas de pantalla de interfaces de usuario multilingües:

using IronOcr;

// Configure for multiple languages
var ocr = new IronTesseract();
ocr.AddSecondaryLanguage(OcrLanguage.ChineseSimplified);
ocr.AddSecondaryLanguage(OcrLanguage.Japanese);

using var input = new OcrInput();
input.LoadImage("multilingual-screenshot.png");

// Process with language detection
OcrPhotoResult result = ocr.ReadScreenShot(input);
Console.WriteLine($"Extracted multilingual text: {result.Text}");

Optimización del rendimiento para el procesamiento por lotes

Cuando proceses varias capturas de pantalla, aplica estas estrategias de optimización:

using IronOcr;
using System.Collections.Generic;
using System.Threading.Tasks;

public async Task ProcessScreenshotBatchAsync(List<string> screenshotPaths)
{
    var ocr = new IronTesseract();
    
    // Process screenshots in parallel for better performance
    var tasks = screenshotPaths.Select(async path =>
    {
        using var input = new OcrInput();
        input.LoadImage(path);
        
        // Apply consistent preprocessing
        input.DeNoise();
        
        var result = await Task.Run(() => ocr.ReadScreenShot(input));
        return new { Path = path, Result = result };
    });
    
    var results = await Task.WhenAll(tasks);
    
    // Process results
    foreach (var item in results)
    {
        Console.WriteLine($"File: {item.Path}");
        Console.WriteLine($"Text: {item.Result.Text}");
        Console.WriteLine($"Confidence: {item.Result.Confidence:P2}");
    }
}

Prácticas recomendadas para el OCR de capturas de pantalla

  1. Calidad de captura: Capture capturas de pantalla en resolución nativa sin escalado
  2. Selección de formato: Use el formato PNG para preservar la calidad sin pérdida
  3. Preprocesamiento: Aplique filtros apropiados según el contenido de la captura de pantalla
  4. Umbrales de confianza: Implemente validación basada en confianza para aplicaciones críticas
  5. Seguimiento del progreso: Para operaciones largas, implementa seguimiento del progreso

Casos de uso comunes

El método ReadScreenshot es ideal para:

  • Pruebas y verificación automáticas de IU
  • Sistemas de gestión de activos digitales
  • Herramientas de soporte al cliente para capturar mensajes de error
  • Automatización de documentación
  • Herramientas de accesibilidad para lectores de pantalla
  • Juegos y aplicaciones de streaming

Características de la integración con IronOCR

La capacidad de lectura de capturas de pantalla se integra perfectamente con otras funciones de IronOCR. Explore la completa manipulación de resultados de OCR para exportar datos en varios formatos, o sumérjase en la configuración avanzada de Teseract para ajustar la precisión del reconocimiento.

Resumen

El método ReadScreenshot de IronOCR proporciona una solución poderosa y optimizada para extraer texto de capturas de pantalla. Gracias al preprocesamiento especializado, la alta precisión y los completos datos de resultados, permite a los desarrolladores crear aplicaciones sólidas que procesan de forma fiable el contenido de las capturas de pantalla. Ya sea construyendo herramientas de automatización, soluciones de accesibilidad o sistemas de extracción de datos, el método ReadScreenshot ofrece el rendimiento y la precisión necesarios para entornos de producción.

Preguntas Frecuentes

¿Qué hace que la extracción de OCR de capturas de pantalla sea un reto?

Las capturas de pantalla presentan desafíos únicos para el reconocimiento óptico de caracteres debido a sus dimensiones y niveles de ruido variables. IronOCR aborda estos problemas con su método especializado ReadScreenshot, que aplica una reducción automática del ruido y una mejora del contraste optimizada específicamente para el contenido de las capturas de pantalla.

¿Qué formatos de archivo admite el OCR de capturas de pantalla?

El método ReadScreenshot de IronOCR admite formatos de archivo de imagen comunes, incluidos PNG, JPG y BMP, lo que lo hace compatible con la mayoría de las herramientas y aplicaciones de captura de pantalla.

¿En qué se diferencia el método ReadScreenshot de los métodos OCR estándar?

A diferencia de los métodos de OCR estándar de IronOCR, el método ReadScreenshot aplica optimizaciones de preprocesamiento específicas adaptadas al contenido de las capturas de pantalla, incluida la reducción automática del ruido, la mejora del contraste y un mejor manejo de las fuentes y los elementos de interfaz de usuario con suavizado.

¿Qué paquete adicional se necesita para la función OCR de capturas de pantalla?

Para utilizar la función ReadScreenshot en IronOCR, es necesario instalar el paquete IronOcr.Extension.AdvancedScan, que proporciona capacidades avanzadas de visión por ordenador que mejoran la precisión del reconocimiento de texto de las capturas de pantalla.

¿En cuánto tiempo puedo empezar a extraer texto de capturas de pantalla?

Con IronOCR, puede extraer texto de capturas de pantalla en segundos cargando la captura de pantalla en un OcrInput, llamando a ReadScreenShot y accediendo inmediatamente al texto extraído, la puntuación de confianza y las regiones de texto a través de OcrPhotoResult.

¿Qué tipos de contenido optimiza el OCR de capturas de pantalla?

La optimización de las capturas de pantalla de IronOCR incluye la detección automática de los elementos de la interfaz de usuario, un mejor reconocimiento de las fuentes del sistema en los distintos sistemas operativos y un mejor manejo del texto con suavizado que suele encontrarse en las aplicaciones modernas.

¿Puedo procesar regiones específicas de una captura de pantalla?

Sí, IronOCR admite el procesamiento de regiones específicas de capturas de pantalla, lo que le permite centrarse en áreas concretas de interés en lugar de procesar toda la imagen, lo que puede mejorar el rendimiento y la precisión.

¿Es compatible el contenido multilingüe con el OCR de capturas de pantalla?

El método ReadScreenshot de IronOCR puede manejar contenido multilingüe en capturas de pantalla, por lo que es adecuado para aplicaciones internacionales e interfaces de usuario multilingües.

Is PNG the best format for screenshots when using IronOCR?

Yes, using PNG format is recommended for screenshots as it preserves text clarity best due to its lossless compression, leading to more accurate OCR results.

What are some common use cases for IronOCR's `ReadScreenshot` method?

Common use cases for the `ReadScreenshot` method include automated UI testing, digital asset management, customer support tools, documentation automation, and accessibility tools for screen readers.

Curtis Chau
Escritor Técnico

Curtis Chau tiene una licenciatura en Ciencias de la Computación (Carleton University) y se especializa en el desarrollo front-end con experiencia en Node.js, TypeScript, JavaScript y React. Apasionado por crear interfaces de usuario intuitivas y estéticamente agradables, disfruta trabajando con frameworks modernos y creando manuales bien estructurados y visualmente atractivos.

...
Leer más

¿Listo para empezar?

Nuget Downloads 6,236,385Versión:2026.9recién lanzado

Obtenga su Clave de Prueba de 30 días gratis al instante.
No se requiere tarjeta de crédito ni creación de cuenta
Biblioteca C# NuGet para PDF
Instalar con NuGet

Versión: 2026.9

PM > Install-Package IronOcr
nuget.org/packages/IronOcr/
  1. En el Explorador de Soluciones, haga clic derecho en Referencias, Administrar Paquetes NuGet
  2. Selecciona Examinar y busca "IronOCR"
  3. Seleccione el paquete e instale
C# PDF DLL
Descargar DLL

Versión: 2026.9

o descargar el instalador de Windows aquí.

  1. Descarga y descomprime IronOCR en una ubicación como ~/Libs dentro de tu directorio de Solución
  2. En Visual Studio Solution Explorer, haz clic derecho en Referencias. Selecciona Examinar, "IronOCR.dll"

Licencias desde $999

Key in blue circle

Obtenga su clave de prueba gratuita de 30 días al instante.

Your trial license will be sent to your email address

Sin limitaciones. 100 % desbloqueado. Sin tarjeta de crédito.

bullet_checkedNo se requiere tarjeta de crédito ni creación de cuentaSin limitaciones. 100 % desbloqueado. Sin tarjeta de crédito.
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried IronPDF
Obtén tu Consulta Sin Compromiso
Completa el formulario a continuación o envía un correo a sales@ironsoftware.com
Tus detalles siempre serán mantenidos confidenciales.
Confiado por millones de ingenieros en todo el mundo
Logos de clientes de Iron Software
Obtenga su Clave de Prueba de 30 días gratis al instante.
No se requiere tarjeta de crédito ni creación de cuenta