IRONSOFTWAREHOME

Como Encontrar Texto com Visão Computacional em C#

Curtis Chau
Curtis Chau
Updated: 4 de junho de 2026

O IronOCR usa visão computacional OpenCV para detectar automaticamente regiões de texto em imagens antes do processamento OCR. Isso melhora a precisão para textos ruidosos, com várias regiões ou distorções, focando o reconhecimento Tesseract apenas nas áreas de texto identificadas, melhorando significativamente os resultados da extração em comparação com o processamento de imagens inteiras.

Início Rápido: Detectar e OCR a Região de Texto Primária

Este exemplo demonstra a extração imediata de texto: carregue uma imagem, use a Visão Computacional do IronOCR para detectar automaticamente a principal região de texto com FindTextRegion(), depois execute .Read(...) para extrair texto em uma linha.

  1. 1Install IronOCR with NuGet Package Manager

    PM > Install-Package IronOcr

  2. 2Copie e execute este trecho de código.

    using var result = new IronTesseract().Read(new OcrInput().LoadImage("image.png").FindTextRegion());
    C#
  3. 3Implante para testar em seu ambiente de produção.

    Comece a usar IronOCR em seu projeto hoje com uma avaliação gratuita
    arrow pointer

Como Instalo o IronOcr.ComputerVision via Pacote NuGet?

Os métodos OpenCV que realizam Visão Computacional no IronOCR são visíveis no pacote NuGet regular do IronOCR. Para orientações detalhadas sobre a instalação, veja nosso guia de instalação do NuGet.

Por Que o IronOCR Exige um Pacote de Visão Computacional Separado?

Usar esses métodos requer a instalação do IronOcr.ComputerVision via NuGet na solução. Você será solicitado a baixá-lo se não tiver instalado. A funcionalidade de visão computacional aproveita algoritmos OpenCV que melhoram significativamente a precisão da detecção de texto, semelhante às técnicas usadas em nosso reconhecimento de placa de veículo e escaneamento de passaportes.

Qual Pacote Específico de Plataforma Devo Instalar?

Como Instalar Usando o Console do Gerenciador de Pacotes?

Instale usando o NuGet Package Manager ou cole o seguinte no Console do Gerenciador de Pacotes:

PM > Install-Package IronOcr.ComputerVision.Windows

Isso fornece os assemblies necessários para usar o IronOCR Visão Computacional com nosso arquivo modelo.

Quais Métodos de Visão Computacional Estão Disponíveis no IronOCR?

Exemplos de código estão incluídos mais adiante neste tutorial. Aqui está uma visão geral dos métodos atualmente disponíveis:

MétodoExplicação
FindTextRegionDetecte regiões que contenham elementos de texto e instrua o Tesseract a procurar texto apenas na área em que o texto foi detectado.
FindMultipleTextRegionsDetecte áreas que contenham elementos de texto e divida a página em imagens separadas com base nas regiões de texto.
GetTextRegionsScans the image and returns a list of text regions as List<CropRectangle>.

Como Uso o FindTextRegion para Detectar Áreas de Texto?

FindTextRegion usa visão computacional para detectar regiões contendo elementos de texto em cada página de um objeto OcrInput. Este método é particularmente útil ao processar imagens com texto disperso ou quando você precisa melhorar o desempenho focando apenas em áreas que contêm texto.

Qual é o Uso Básico do FindTextRegion?

using IronOcr;

var ocr = new IronTesseract();
using var input = new OcrInput();
input.LoadImage("/path/file.png");

input.FindTextRegion();
OcrResult result = ocr.Read(input);
string resultText = result.Text;
Cuidado: Essa sobrecarga de método está atualmente descontinuada em IronOcr 2025.6.x e não aceita parâmetros personalizados.

Como Posso Personalizar os Parâmetros do FindTextRegion?

Chamare este método com parâmetros personalizados para ajustar a detecção de texto. Estes parâmetros funcionam de forma semelhante às nossas configurações de filtro de imagem:

using IronOcr;

var ocr = new IronTesseract();
using var input = new OcrInput();
input.LoadImage("/path/file.png");

input.FindTextRegion();
OcrResult result = ocr.Read(input);
string resultText = result.Text;

Como é o FindTextRegion na Prática?

Neste exemplo, eu uso a seguinte imagem para um método que precisa recortar para áreas que contêm texto, mas as imagens de entrada podem variar quanto à localização do texto. Eu uso FindTextRegion para restringir a varredura a uma área em que a Visão Computacional detectou texto. Essa abordagem é semelhante às técnicas usadas no nosso tutorial de áreas de conteúdo e regiões de recorte. Esta é uma imagem de exemplo:

Estatísticas da empresa Iron Software 2022 mostrando métricas de desenvolvedores e dados de desempenho de negócios
using IronOcr;
using IronSoftware.Drawing;
using System;
using System.Linq;

var ocr = new IronTesseract();
using var input = new OcrInput();
input.LoadImage("wh-words-sign.jpg");

// Find the text region using Computer Vision
Rectangle textCropArea = input.GetPages().First().FindTextRegion();

// For debugging and demonstration purposes, lets see what region it found:
input.StampCropRectangleAndSaveAs(textCropArea, Color.Red, "image_text_area", AnyBitmap.ImageFormat.Png);

// Looks good, so let us apply this region to hasten the read:
var ocrResult = ocr.Read("wh-words-sign.jpg", textCropArea);
Console.WriteLine(ocrResult.Text);

Como Faço para Depurar e Verificar a Detecção de Região de Texto?

Este código tem duas saídas. O primeiro é um arquivo .png salvo por StampCropRectangleAndSaveAs usado para depuração. Essa técnica também é abordada no nosso guia de realce de textos para depuração. Podemos ver onde o IronCV (Visão Computacional) detectou o texto:

Estatísticas da Iron Software 2022 com caixa de limite vermelha mostrando a funcionalidade de detecção de texto FindTextRegion

A detecção identifica com precisão a área de texto. A segunda saída é o próprio texto:

IRONSOFTWARE

50,000+

Developers in our active community

10,777,061 19,313
NuGet downloads Support tickets resolved
50%+ 80%+
Engineering Team growth Support Team growth
$25,000+

Raised with #TEAMSEAS to clean our beaches & waterways
Text

Como Uso o FindMultipleTextRegions para Múltiplas Áreas de Texto?

FindMultipleTextRegions pega todas as páginas de um objeto OcrInput e usa visão computacional para detectar áreas contendo elementos de texto, depois divide a entrada em imagens separadas com base nas regiões de texto. Isto é particularmente útil para processar documentos com múltiplas áreas de texto distintas, semelhante à nossa funcionalidade de leitura de tabela em documento:

Qual é o Uso Básico do FindMultipleTextRegions?

using IronOcr;

var ocr = new IronTesseract();
using var input = new OcrInput();
input.LoadImage("/path/file.png");

input.FindMultipleTextRegions();
OcrResult result = ocr.Read(input);
string resultText = result.Text;
Cuidado: A partir do IronOCR v2025.6.x, o método FindMultipleTextRegions não suporta mais parâmetros personalizados.

Como Posso Personalizar os Parâmetros do FindMultipleTextRegions?

Chame este método com parâmetros personalizados para controlar como as regiões são detectadas e separadas:

using IronOcr;

var ocr = new IronTesseract();
using var input = new OcrInput();
input.LoadImage("/path/file.png");

input.FindMultipleTextRegions();
OcrResult result = ocr.Read(input);
string resultText = result.Text;

Como Processar Páginas Individuais com o FindMultipleTextRegions?

Outra sobrecarga do método FindMultipleTextRegions pega uma Página OCR e retorna uma lista de Páginas OCR, uma para cada região de texto nela. Esta abordagem ajuda a lidar com layouts complexos, semelhante às técnicas descritas no nosso guia de processamento de TIFF multipágina:

using IronOcr;
using System.Collections.Generic;
using System.Linq;

int pageIndex = 0;
using var input = new OcrInput();
input.LoadImage("/path/file.png");

var selectedPage = input.GetPages().ElementAt(pageIndex);
List<OcrInputPage> textRegionsOnPage = selectedPage.FindMultipleTextRegions();

Como Uso o GetTextRegions para Obter as Coordenadas das Regiões de Texto?

GetTextRegions retorna uma lista de áreas de recorte onde texto foi detectado em uma página. Este método é particularmente útil quando você precisa das coordenadas das regiões de texto para processamento posterior ou na implementação de fluxos de trabalho OCR personalizados. Para mais detalhes sobre como trabalhar com resultados, consulte nossa documentação da classe OcrResult:

Quando Devo Usar o GetTextRegions em Vez do FindTextRegion?

/* :path=/static-assets/ocr/content-code-examples/how-to/computer-vision-gettextregions.cs */
using IronOcr;
using IronSoftware.Drawing;
using System;
using System.Collections.Generic;
using System.Linq;

// Create a new IronTesseract object for OCR
var ocr = new IronTesseract();

// Load an image into OcrInput
using var input = new OcrInput();
input.LoadImage("/path/file.png");

// Get the first page from the input
var firstPage = input.GetPages().First();

// Get all text regions detected on this page
List<Rectangle> textRegions = firstPage.GetTextRegions();

// Display information about each detected region
Console.WriteLine($"Found {textRegions.Count} text regions:");
foreach (var region in textRegions)
{
    Console.WriteLine($"Region at X:{region.X}, Y:{region.Y}, Width:{region.Width}, Height:{region.Height}");
}

// You can also process each region individually
foreach (var region in textRegions)
{
    var regionResult = ocr.Read(input, region);
    Console.WriteLine($"Text in region: {regionResult.Text}");
}

Quais São os Casos de Uso Comuns para a Visão Computacional em OCR?

A visão computacional melhora significativamente a precisão do OCR em cenários desafiadores. Aqui estão aplicações práticas:

  1. Análise de Layout de Documento: Identifique e processe automaticamente diferentes seções de documentos complexos. Especialmente útil com documentos escaneados.
  2. Texto em Múltiplas Colunas: Separe e leia colunas independentemente para jornais ou revistas. Use processamento multithread para resultados mais rápidos.
  3. Conteúdo Misto: Distinguir entre regiões de texto e gráficos em documentos. Útil ao processar fotos com texto embutido.
  4. Otimização de Desempenho: Focar o processamento OCR apenas em áreas que contêm texto. Veja nosso guia de configuração rápida de OCR.
  5. Controle de Qualidade: Verifique a detecção de texto antes do processamento completo de OCR. Nossa função de rastreamento de progresso monitora cada estágio.

Com as configurações corretas e arquivos de entrada, o OCR pode alcançar uma capacidade de leitura quase humana. Para resultados ótimos, combine visão computacional com nossos filtros de otimização de imagem para alcançar a melhor precisão possível do OCR. Ao trabalhar com imagens de baixa qualidade, nosso guia sobre corrigir digitalizações de baixa qualidade fornece técnicas de pré-processamento valiosas.

Técnicas Avançadas de Visão Computacional

Para desenvolvedores que buscam ultrapassar os limites de precisão do OCR, considere essas abordagens avançadas:

Perguntas frequentes

O que é visão computacional em OCR e como ela melhora a extração de texto?

A Visão Computacional no IronOCR utiliza algoritmos OpenCV para detectar automaticamente regiões de texto em imagens antes do processamento OCR. Isso melhora significativamente a precisão para textos ruidosos, com múltiplas regiões ou distorcidos, concentrando o reconhecimento do Tesseract apenas nas áreas de texto identificadas, em vez de processar imagens inteiras.

Como posso implementar rapidamente OCR de visão computacional em C#?

O IronOCR permite implementar OCR por visão computacional em apenas uma linha de código: use o IronTesseract com o método FindTextRegion() para detectar automaticamente a região de texto principal e, em seguida, execute .Read() para extrair o texto imediatamente.

Por que preciso instalar um pacote de Visão Computacional separado?

O IronOCR requer o pacote NuGet IronOcr.ComputerVision, pois a funcionalidade de visão computacional utiliza algoritmos OpenCV. Esses algoritmos melhoram significativamente a precisão da detecção de texto e são essenciais para recursos como reconhecimento de placas de veículos e digitalização de passaportes.

Qual pacote de Visão Computacional específico para a plataforma devo instalar?

O IronOCR oferece pacotes específicos para cada plataforma: IronOcr.ComputerVision.Windows para sistemas Windows, IronOcr.ComputerVision.Linux para distribuições Linux e IronOcr.ComputerVision.MacOS para ambientes macOS.

Como posso detectar várias regiões de texto em uma imagem?

O IronOCR oferece o método FindMultipleTextRegions para separar a imagem original em múltiplas imagens com base nas regiões de texto detectadas. Você também pode usar o método GetTextRegions para obter uma lista das áreas recortadas onde o texto foi detectado.

Posso verificar quais regiões de texto foram detectadas antes do processamento?

Sim, o IronOCR inclui o método StampCropRectangleAndSaveAs, que permite verificar quais regiões de texto foram detectadas pelos algoritmos de Visão Computacional antes de executar o processo de OCR propriamente dito.

What is the use of the GetTextRegions method in IronOCR?

The GetTextRegions method in IronOCR provides a list of detected text regions as coordinates, useful for further processing or implementing custom OCR workflows.

How can IronOCR assist in processing documents with multiple text areas?

IronOCR uses the FindMultipleTextRegions method to detect and process documents with multiple distinct text areas by automatically separating them into individual sections for better OCR performance.

Why might IronOCR require a separate Computer Vision package?

The separate Computer Vision package for IronOCR, available via NuGet, is necessary to utilize advanced text detection features powered by OpenCV algorithms, enhancing OCR accuracy beyond standard capabilities.

What common uses does computer vision in IronOCR support?

Computer vision in IronOCR can be used for document layout analysis, multi-column text recognition, distinguishing mixed content, performance optimizations, and quality control in OCR processes.

Curtis Chau
Redator Técnico

Curtis Chau é bacharel em Ciência da Computação (Universidade Carleton) e se especializa em desenvolvimento front-end, com experiência em Node.js, TypeScript, JavaScript e React. Apaixonado por criar interfaces de usuário intuitivas e esteticamente agradáveis, Curtis gosta de trabalhar com frameworks modernos e criar manuais bem estruturados e visualmente atraentes.

...
Leia mais

Pronto para começar?

Nuget Downloads 6,236,385Versão:2026.9recém-lançado

Obtenha o seu GRÁTIS

Obtenha uma chave de avaliação de 30 dias instantaneamente.

bullet_checkedNão é necessário cartão de crédito nem criação de conta.
bullet_testTeste em produção
sem marcas d'água
bullet_calendar30 dias completos
produto funcional
bullet_supportSuporte técnico 24 horas por dia,
5 dias por semana, durante o teste
Obtenha sua chave de avaliação gratuita de 30 dias instantaneamente.
Não é necessário cartão de crédito nem criação de conta.
Biblioteca NuGet C# para PDF
Instalar com NuGet

Versão: 2026.9

PM > Install-Package IronOcr
nuget.org/packages/IronOcr/
  1. No Solution Explorer, clique com o botão direito do mouse em Referências e selecione Gerenciar Pacotes NuGet.
  2. Selecione Procurar e pesquise "IronOCR".
  3. Selecione o pacote e instale.
DLL de PDF em C#
Baixar DLL

Versão: 2026.9

ou faça o download do Windows Installer aqui .

  1. Baixe e descompacte o IronOCR em um local como ~/Libs dentro do diretório da sua solução.
  2. No Solution Explorer do Visual Studio, clique com o botão direito do mouse em Referências. Selecione Procurar e digite "IronOCR.dll".

Licenças a partir de US$ 749

Key in blue circle

Obtenha sua chave de avaliação gratuita de 30 dias instantaneamente.

Your trial license will be sent to your email address

Sem limitações. 100% desbloqueado. Sem cartão de crédito.

bullet_checkedNão é necessário cartão de crédito nem criação de conta.Sem limitações. 100% desbloqueado. Sem cartão de crédito.
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried IronPDF
Agende sua consulta sem compromisso.
Preencha o formulário abaixo ou envie um e-mail para sales@ironsoftware.com
Os seus dados serão sempre mantidos em sigilo.
Aprovado por milhões de engenheiros em todo o mundo.
Logotipos dos clientes da Iron Software
Obtenha sua chave de avaliação gratuita de 30 dias instantaneamente.
Não é necessário cartão de crédito nem criação de conta.