Latin Alphabet OCR in C# and .NET
IronOCR ist eine C#-Softwarekomponente, die .NET-Programmierern ermöglicht, Text aus Bildern und PDF-Dokumenten in 126 Sprachen, einschließlich des lateinischen Alphabets, zu lesen.
Es ist eine erweiterte Abspaltung von Tesseract, die exklusiv für .NET-Entwickler entwickelt wurde und regelmäßig andere Tesseract-Engines sowohl in Bezug auf Geschwindigkeit als auch Genauigkeit übertrifft.
Inhalt von IronOcr.Languages.LatinAlphabet
Dieses Paket enthält 64 OCR-Sprachen for .NET:
- LatinAlphabet
- LatinAlphabetBest
- LatinAlphabetFast
Download
Sprachpaket für das lateinische Alphabet [latine]
Installation
Das Erste, was wir tun müssen, ist das Lateinische Alphabet OCR-Paket in Ihr .NET-Projekt zu installieren.
Beispielcode
Dieses C#-Codebeispiel liest Text in lateinischem Alphabet aus einem Bild oder PDF-Dokument.
// Install the IronOCR.languages.LatinAlphabet package first
using IronOcr;
var Ocr = new IronTesseract(); // Initialize IronTesseract instance
// Set the OCR language to LatinAlphabet
Ocr.Language = OcrLanguage.LatinAlphabet;
// Define the input image or PDF you want to read
using (var Input = new OcrInput(@"images\LatinAlphabet.png"))
{
// Perform OCR reading on the input
var Result = Ocr.Read(Input);
// Extract the recognized text
var AllText = Result.Text;
// Output the recognized text
Console.WriteLine(AllText);
}' Install the IronOCR.languages.LatinAlphabet package first
Imports IronOcr
Dim Ocr As New IronTesseract() ' Initialize IronTesseract instance
' Set the OCR language to LatinAlphabet
Ocr.Language = OcrLanguage.LatinAlphabet
' Define the input image or PDF you want to read
Using Input As New OcrInput("images\LatinAlphabet.png")
' Perform OCR reading on the input
Dim Result = Ocr.Read(Input)
' Extract the recognized text
Dim AllText = Result.Text
' Output the recognized text
Console.WriteLine(AllText)
End UsingErklärung
-
IronTesseract-Initialisierung: Eine Instanz von
IronTesseractwird initialisiert, die die OCR-Verarbeitung übernimmt. -
Spracheinstellungen: Die OCR-Sprache wird auf
LatinAlphabetgesetzt, welche eine der verfügbaren Sprachen im IronOCR-Paket ist. -
Eingabespezifikation: Ein
OcrInput-Objekt wird erstellt, das den Pfad zum Bild oder PDF angibt, aus dem der Text extrahiert wird. -
OCR-Ausführung: Die
Read-Methode derIronTesseract-Instanz wird aufgerufen, um dasOcrInputzu verarbeiten. Dies gibt einResult-Objekt zurück, das den extrahierten Text enthält. -
Textextraktion: Die
Text-Eigenschaft desResult-Objekts wird verwendet, um auf den erkannten Text zuzugreifen. -
Ausgabe: Der erkannte Text wird zur Überprüfung auf der Konsole ausgegeben.
Stellen Sie sicher, dass der Dateipfad in OcrInput korrekt auf Ihre Bild- oder PDF-Datei verweist, um "Datei nicht gefunden"-Ausnahmen zu vermeiden.

Curtis Chau hat einen Bachelor-Abschluss in Informatik von der Carleton University und ist spezialisiert auf Frontend-Entwicklung mit Expertise in Node.js, TypeScript, JavaScript und React. Leidenschaftlich widmet er sich der Erstellung intuitiver und ästhetisch ansprechender Benutzerschnittstellen und arbeitet gerne mit modernen Frameworks sowie der Erstellung gut strukturierter, optisch ansprechender Handbücher.