Bengali OCR in C# and .NET
Andere Versionen dieses Dokuments:
IronOCR ist eine C#-Softwarekomponente, die es .NET-Entwicklern ermöglicht, Text aus Bildern und PDF-Dokumenten in 126 Sprachen, einschließlich Bengali, zu lesen. Es ist eine erweiterte Abspaltung von Tesseract, die exklusiv für .NET-Entwickler entwickelt wurde und regelmäßig andere Tesseract-Engines sowohl in Bezug auf Geschwindigkeit als auch Genauigkeit übertrifft.
Inhalt von IronOcr.Languages.Bengali
Dieses Paket enthält 114 OCR-Sprachen for .NET:
- Bengalisch
- BengalischschBeste
- BengalischschSchnell
- BengalischschAlphabet
- BengalischschAlphabetBeste
- Bengalischsches AlphabetFast
Download
Bengalisch Sprachpaket [Bangla]
Installation
Das erste, was wir tun müssen, ist unser Bengalisch-OCR-Paket in Ihr .NET-Projekt zu installieren.
Beispielcode
Dieses C#-Codebeispiel liest bengalischen Text aus einem Bild oder PDF-Dokument.
// Import the IronOcr namespace
using IronOcr;
class BengaliOcrExample
{
static void Main()
{
// Create an instance of IronTesseract
var Ocr = new IronTesseract();
// Specify the language for OCR
Ocr.Language = OcrLanguage.Bengali;
// Process the image and extract text
using (var Input = new OcrInput(@"images\Bengali.png"))
{
// Perform OCR on the input image
var Result = Ocr.Read(Input);
// Get the extracted text
var AllText = Result.Text;
// Output the extracted text to the console
System.Console.WriteLine(AllText);
}
}
}' Import the IronOcr namespace
Imports IronOcr
Friend Class BengaliOcrExample
Shared Sub Main()
' Create an instance of IronTesseract
Dim Ocr = New IronTesseract()
' Specify the language for OCR
Ocr.Language = OcrLanguage.Bengali
' Process the image and extract text
Using Input = New OcrInput("images\Bengali.png")
' Perform OCR on the input image
Dim Result = Ocr.Read(Input)
' Get the extracted text
Dim AllText = Result.Text
' Output the extracted text to the console
System.Console.WriteLine(AllText)
End Using
End Sub
End ClassErklärung
-
Importieren Sie IronOCR: Wir beginnen mit dem Importieren des
IronOcrNamespace, der Klassen und Methoden enthält, die für OCR-Operationen erforderlich sind. -
Erstellen Sie eine IronTesseract-Instanz: Wir erstellen eine Instanz von
IronTesseract, die Hauptklasse für die Durchführung von OCR. -
Sprache festlegen: Wir stellen die OCR-Sprache auf Bengalisch mithilfe von
OcrLanguage.Bengaliein. -
OcrInput: Wir geben den Pfad zum Bild an, aus dem wir Text extrahieren möchten. Ein
OcrInputObjekt wird verwendet, um die Eingabedatei zu laden und vorzubereiten. -
Lesen und Extrahieren von Text: Mit der
ReadMethode verarbeiten wir das Bild, um den Textinhalt zu lesen. Der Text wird inResult.Textgespeichert. -
Text ausgeben: Schließlich drucken wir den extrahierten Text auf die Konsole, um die Ausgabe zu überprüfen.

Curtis Chau hat einen Bachelor-Abschluss in Informatik von der Carleton University und ist spezialisiert auf Frontend-Entwicklung mit Expertise in Node.js, TypeScript, JavaScript und React. Leidenschaftlich widmet er sich der Erstellung intuitiver und ästhetisch ansprechender Benutzerschnittstellen und arbeitet gerne mit modernen Frameworks sowie der Erstellung gut strukturierter, optisch ansprechender Handbücher.