Corsican OCR in C# and .NET

This article was translated from English: Does it need improvement?
Translated
View the article in English
Inne wersje tego dokumentu:

IronOCR to komponent oprogramowania w C#, który pozwala kodujacym w .NET odczytywac tekst z obrazow i dokumentow PDF w 126 jezykach, w tym w korsykanskim.

Jest to zaawansowany fork Tesseracta, zbudowany wyłącznie dla deweloperów .NET i regularnie przewyższający inne silniki Tesseract pod względem szybkości i dokładności.

Zawartosc IronOcr.Languages.Corsican

Ten pakiet zawiera 49 języków OCR dla .NET:

  • Korsykanski
  • KorsykanskiNajlepszy
  • KorsykanskiSzybki

Pobieranie

Corsican Language Pack [corsu]

Instalacja

Pierwsza rzecza, którą musimy zrobic, jest zainstalowanie pakietu OCR korsykanskiego do twojego projektu .NET.

Install-Package IronOcr.Languages.Corsican

Przyklad kodu

Ten przyklad kodu C# odczytuje tekst korsykanski z obrazu lub dokumentu PDF.

// First, ensure the IronOcr.Languages.Corsican package is installed
// You can use the NuGet Package Manager console:
// PM> Install-Package IronOcr.Languages.Corsican

using IronOcr;

var Ocr = new IronTesseract();

// Set the OCR language to Corsican
Ocr.Language = OcrLanguage.Corsican;

// Reading text from an image file
using (var Input = new OcrInput(@"images\Corsican.png"))
{
    // Perform OCR on the input image
    var Result = Ocr.Read(Input);

    // Extract all recognized text from the OCR result
    var AllText = Result.Text;
}
// First, ensure the IronOcr.Languages.Corsican package is installed
// You can use the NuGet Package Manager console:
// PM> Install-Package IronOcr.Languages.Corsican

using IronOcr;

var Ocr = new IronTesseract();

// Set the OCR language to Corsican
Ocr.Language = OcrLanguage.Corsican;

// Reading text from an image file
using (var Input = new OcrInput(@"images\Corsican.png"))
{
    // Perform OCR on the input image
    var Result = Ocr.Read(Input);

    // Extract all recognized text from the OCR result
    var AllText = Result.Text;
}
' First, ensure the IronOcr.Languages.Corsican package is installed
' You can use the NuGet Package Manager console:
' PM> Install-Package IronOcr.Languages.Corsican

Imports IronOcr

Private Ocr = New IronTesseract()

' Set the OCR language to Corsican
Ocr.Language = OcrLanguage.Corsican

' Reading text from an image file
Using Input = New OcrInput("images\Corsican.png")
	' Perform OCR on the input image
	Dim Result = Ocr.Read(Input)

	' Extract all recognized text from the OCR result
	Dim AllText = Result.Text
End Using
$vbLabelText   $csharpLabel

W tym kodzie:

  • Tworzymy instancje IronTesseract, która jest uzywana do wykonywania OCR.
  • Okreslamy jezyk jako korsykanski za pomoca OcrLanguage.Corsican.
  • Odczytujemy z obrazu wejsciowego o nazwie Corsican.png.
  • Metoda Read z Ocr wykonuje OCR i zwraca wynik, z którego mozemy wyciagnac rozpoznany tekst.