Vietnamese OCR in C# and .NET
Otras versiones de este documento:
IronOCR es un componente de software C# que permite a los programadores de .NET leer texto de imágenes y documentos PDF en 126 idiomas, incluido el vietnamita.
Es una rama avanzada de Tesseract, construida exclusivamente para desarrolladores de .NET y supera regularmente a otros motores de Tesseract tanto en velocidad como en precisión.
Contenido de IronOcr.Languages.Vietnamese
Este paquete contiene 132 idiomas OCR for .NET:
- Vietnamita
- VietnamitaBest
- VietnamitaFast
- Alfabeto vietnamita
- Alfabeto vietnamitaBest
- Alfabeto vietnamitaFast
Descargar
Paquete de idioma vietnamita [Tiếng Việt]
Instalación
Lo primero que tenemos que hacer es instalar nuestro paquete OCR vietnamita en su proyecto .NET.
Ejemplo de código
Este ejemplo de código en C# lee texto vietnamita de una imagen o documento PDF.
// You need to install the IronOcr.Languages.Vietnamese package using the following NuGet command before running this code:
// PM> Install-Package IronOcr.Languages.Vietnamese
using IronOcr;
var Ocr = new IronTesseract();
// Set the OCR language to Vietnamese
Ocr.Language = OcrLanguage.Vietnamese;
using (var Input = new OcrInput(@"images\Vietnamese.png"))
{
// Perform OCR on the input image
var Result = Ocr.Read(Input);
// Extract all recognized text
var AllText = Result.Text;
// Example: Output the extracted text to the console
Console.WriteLine(AllText);
}' You need to install the IronOcr.Languages.Vietnamese package using the following NuGet command before running this code:
' PM> Install-Package IronOcr.Languages.Vietnamese
Imports IronOcr
Dim Ocr As New IronTesseract()
' Set the OCR language to Vietnamese
Ocr.Language = OcrLanguage.Vietnamese
Using Input As New OcrInput("images\Vietnamese.png")
' Perform OCR on the input image
Dim Result = Ocr.Read(Input)
' Extract all recognized text
Dim AllText = Result.Text
' Example: Output the extracted text to the console
Console.WriteLine(AllText)
End UsingEn este ejemplo de código:
- Creamos una instancia de
IronTesseract. - Establece el idioma en vietnamita utilizando
Ocr.Language = OcrLanguage.Vietnamese;. - Crea un objeto
OcrInputcon la ruta a la imagen o al PDF. - Llama al método
Readpara realizar el OCR y obtener el texto extraído. - El texto extraído se almacena en
AllText, que se puede utilizar según sea necesario, por ejemplo, para mostrarlo o guardarlo en un archivo.

Curtis Chau tiene una licenciatura en Ciencias de la Computación (Carleton University) y se especializa en el desarrollo front-end con experiencia en Node.js, TypeScript, JavaScript y React. Apasionado por crear interfaces de usuario intuitivas y estéticamente agradables, disfruta trabajando con frameworks modernos y creando manuales bien estructurados y visualmente atractivos.