Sinhala OCR in C# and .NET
Andere Versionen dieses Dokuments:
IronOCR ist eine C#-Softwarekomponente, die .NET-Programmierern das Lesen von Text aus Bildern und PDF-Dokumenten in 126 Sprachen, einschließlich Singhalesisch, ermöglicht.
Es ist ein fortgeschrittener Fork von Tesseract, der ausschließlich für .NET-Entwickler entwickelt wurde und sowohl in der Geschwindigkeit als auch in der Genauigkeit regelmäßig andere Tesseract-Engines übertrifft.
Inhalt von IronOcr.Languages.Sinhala
Dieses Paket enthält 114 OCR-Sprachen for .NET:
- Singhalesisch
- SinghalesischBest
- SinghalesischFast
- SinghalesischAlphabet
- SinghalesischAlphabetBest
- SinghalesischesAlphabetSchnell
Download
Singhalesisches Sprachpaket [සංහල]
Installation
Das erste, was wir tun müssen, ist das Sinhala OCR-Paket in Ihr .NET-Projekt zu installieren.
Beispielcode
Dieses C#-Codebeispiel liest Singhalesischen Text aus einem Bild oder PDF-Dokument.
// Import the IronOcr namespace
using IronOcr;
class SinhalaOcrExample
{
static void Main()
{
// Initialize the IronTesseract OCR engine
var Ocr = new IronTesseract();
// Set the OCR engine to use the Sinhala language
Ocr.Language = OcrLanguage.Sinhala;
// Define the input image or PDF file
using (var Input = new OcrInput(@"images\Sinhala.png"))
{
// Perform OCR on the input
var Result = Ocr.Read(Input);
// Retrieve the recognized text
var AllText = Result.Text;
// Output the recognized text
Console.WriteLine(AllText);
}
}
}' Import the IronOcr namespace
Imports IronOcr
Class SinhalaOcrExample
Shared Sub Main()
' Initialize the IronTesseract OCR engine
Dim Ocr = New IronTesseract()
' Set the OCR engine to use the Sinhala language
Ocr.Language = OcrLanguage.Sinhala
' Define the input image or PDF file
Using Input = New OcrInput("images\Sinhala.png")
' Perform OCR on the input
Dim Result = Ocr.Read(Input)
' Retrieve the recognized text
Dim AllText = Result.Text
' Output the recognized text
Console.WriteLine(AllText)
End Using
End Sub
End ClassErklärung:
- IronTesseract: Dies ist die Hauptklasse der OCR-Engine, die für die Texterkennung verwendet wird.
- Sprache: Gibt die Sprache des zu erkennenden Textes an; in diesem Fall Singhalesisch.
- OcrInput: Repräsentiert die Eingabedatei (Bild oder PDF), bei der die Texterkennung durchgeführt werden muss.
- Lesen: Führt den OCR-Prozess auf der Eingabedatei aus und gibt den erkannten Text zurück.
- Result.Text: Enthält den OCR-erkannten Text aus der Eingabedatei, der für die weitere Verarbeitung oder Anzeige verwendet werden kann.

Curtis Chau hat einen Bachelor-Abschluss in Informatik von der Carleton University und ist spezialisiert auf Frontend-Entwicklung mit Expertise in Node.js, TypeScript, JavaScript und React. Leidenschaftlich widmet er sich der Erstellung intuitiver und ästhetisch ansprechender Benutzerschnittstellen und arbeitet gerne mit modernen Frameworks sowie der Erstellung gut strukturierter, optisch ansprechender Handbücher.