IRONSOFTWAREHOME

Get Started with OCR in C# and VB.NET

Curtis Chau
Curtis Chau
Updated: 22. April 2026

IronOCR ist eine C#-Softwarebibliothek, die es Softwareentwicklern der .NET-Plattform ermöglicht, Text aus Bildern und PDF-Dokumenten zu erkennen und zu lesen. Es ist eine reine .NET OCR-Bibliothek, die die fortschrittlichste Tesseract-Engine verwendet, die bekannt ist.

Installation

Installation mit NuGet Package Manager

Installieren Sie IronOCR in Visual Studio oder über die Befehlszeile mit dem NuGet-Paketmanager. Navigieren Sie in Visual Studio mit zur Konsole:

  • Werkzeuge ->
  • NuGet Paket Manager ->
  • Paketmanager-Konsole

PM > Install-Package IronOcr

Und schauen Sie sich IronOCR auf NuGet an, um mehr über Versionsupdates und Installation zu erfahren.

Es gibt weitere IronOCR NuGet-Pakete für verschiedene Plattformen:

IronOcr.Extensions.AdvancedScan für Linux und macOS

Dieses Paket ist für Benutzer, die Linux und Mac verwenden und die erweiterten Funktionen für IronOCR ebenfalls wünschen.

Fehlerbehebung

Mit dem neuen Update dieses Pakets kombiniert IronOCR die OpenCV-Abhängigkeiten innerhalb des Pakets, um es so zu rationalisieren, dass Entwickler, die derzeit die OpenCV-Abhängigkeiten importieren, den folgenden Fehler erhalten.

The type of namespace name `OpenCvSharp` could not be found(are you missing a using directive or an assembly reference)
Text

Sie können die OpenCV-Namensräume sicher entfernen, und das Problem wird behoben.

Laden Sie die IronOCR .ZIP herunter

Sie können IronOCR stattdessen auch als ZIP-Datei herunterladen. Klicken Sie, um die DLL direkt herunterzuladen. Sobald Sie die .zip-Datei heruntergeladen haben:

Anleitung zur Installation von .NET Framework 4.0+:

  • Binden Sie die IronOcr.dll im Ordner net40 in Ihr Projekt ein

  • Fügen Sie Assembly-Referenzen hinzu:

    • System.Konfiguration
    • System.Drawing
  • System.Web

Anleitungen for .NET Standard & .NET Core 2.0+, & .NET 5

  • Binden Sie die IronOcr.dll im Ordner netstandard2.0 in Ihr Projekt ein

  • Und fügen Sie dann eine NuGet-Paketreferenz zu:

    • System.Drawing.Common 4.7 oder höher

Download des IronOCR-Installationsprogramms (nur Windows)

Eine weitere Option ist der Download unseres IronOCR-Installationsprogramms, das alle erforderlichen Ressourcen installiert, damit IronOCR sofort funktioniert. Bitte beachten Sie, dass diese Option nur für Windows-Systeme gilt. Zum Herunterladen des Installationsprogramms bitte hier klicken. Sobald Sie die .zip-Datei heruntergeladen haben:

Anleitung zur Installation von .NET Framework 4.0+:

  • Binden Sie die IronOcr.dll im Ordner net40 in Ihr Projekt ein

  • Fügen Sie Assembly-Referenzen hinzu:

    • System.Konfiguration
    • System.Drawing
  • System.Web

Anleitungen for .NET Standard & .NET Core 2.0+, & .NET 5

  • Binden Sie die IronOcr.dll im Ordner netstandard2.0 in Ihr Projekt ein

  • Und fügen Sie dann eine NuGet-Paketreferenz zu:

    • System.Drawing.Common 4.7 oder höher

Warum IronOCR wählen?

IronOCR ist eine einfach zu installierende, vollständige und gut dokumentierte .NET-Softwarebibliothek.

Entscheiden Sie sich für IronOCR, um eine OCR-Genauigkeit von 99,8 %+ zu erreichen, ohne externe Webdienste zu nutzen, laufende Gebühren zu zahlen oder vertrauliche Dokumente über das Internet zu versenden.

Warum C#-Entwickler IronOCR über Vanilla Tesseract wählen:

  • Installation als einzelne DLL oder NuGet
  • Beinhaltet die Tesseract 5, 4 und 3 Engines sofort nach dem Auspacken.
  • Die Genauigkeit von 99,8 % übertrifft die des normalen Tesseract deutlich.
  • Rasante Geschwindigkeit und MultiThreading
  • MVC, WebApp, Desktop, Konsole & Server-Anwendung kompatibel
  • Kein Exes- oder C++-Code erforderlich.
  • Vollständige PDF-OCR-Unterstützung
  • OCR für fast alle Bilddateien oder PDF-Dateien durchführen
  • Vollständige Unterstützung von .NET Core, Standard und Framework
  • Bereitstellung auf Windows, Mac, Linux, Azure, Docker, Lambda, AWS
  • Lesen von Barcodes und QR-Codes
  • OCR-Ergebnisse als XHTML exportieren
  • OCR in durchsuchbare PDF-Dokumente exportieren
  • Multithreading-Unterstützung
  • 125 internationale Sprachen, die alle über NuGet- oder OcrData-Dateien verwaltet werden
  • Bilder, Koordinaten, Statistiken und Schriftarten extrahieren. Nicht nur Text.
  • Kann zur Weitergabe von Tesseract OCR in kommerziellen und proprietären Anwendungen verwendet werden.

ironOCR glänzt bei der Arbeit mit realen Bildern und unvollkommenen Dokumenten wie Fotos oder Scans mit niedriger Auflösung, die digitales Rauschen oder Unvollkommenheiten aufweisen können

Andere kostenlose OCR-Bibliotheken für die .NET-Plattform, wie andere .NET Tesseract APIs und Webservices, sind für diese realen Anwendungsfälle nicht so gut geeignet.

OCR with Tesseract 5 - Start Coding in C#

Das folgende Codebeispiel zeigt, wie einfach es ist, mit C# oder VB .NET Text aus einem Bild zu lesen.

Einzeiler

string Text = new IronTesseract().Read(@"img\Screenshot.png").Text;

Konfigurierbares Hello World

using IronOcr;

IronTesseract ocr = new IronTesseract();
using OcrInput input = new OcrInput();

// Add multiple images
input.LoadImage("images/sample.jpeg");

OcrResult result = ocr.Read(input);
Console.WriteLine(result.Text);

C# PDF OCR

Der gleiche Ansatz kann auch verwendet werden, um Text aus einem beliebigen PDF-Dokument zu extrahieren.

using IronOcr;

IronTesseract ocr = new IronTesseract();
using OcrInput input = new OcrInput();

// We can also select specific PDF page numbers to OCR
input.LoadPdf("example.pdf", Password: "password");

OcrResult result = ocr.Read(input);
Console.WriteLine(result.Text);

// 1 page for every page of the PDF
Console.WriteLine($"{result.Pages.Length} Pages");

OCR für mehrseitige TIFFs

using IronOcr;

IronTesseract ocr = new IronTesseract();
using OcrInput input = new OcrInput();
var pageindices = new int[] { 1, 2 };
input.LoadImageFrames("multi-frame.tiff", pageindices);
OcrResult result = ocr.Read(input);
Console.WriteLine(result.Text);

Barcodes und QR

Ein einzigartiges Merkmal von IronOCR ist, dass es Barcodes und QR-Codes von Dokumenten lesen kann, während es nach Text scannt. Instanzen der OcrResult.OcrBarcode-Klasse geben dem Entwickler detaillierte Informationen über jeden gescannten Barcode.

using IronOcr;

IronTesseract ocr = new IronTesseract();
ocr.Configuration.ReadBarCodes = true;

using OcrInput input = new OcrInput();
input.LoadImage("img/Barcode.png");

OcrResult Result = ocr.Read(input);
foreach (var Barcode in Result.Barcodes)
{
    // type and location properties also exposed
    Console.WriteLine(Barcode.Value);
}

OCR für bestimmte Bereiche von Bildern

Alle Scan- und Lesemethoden von IronOCR bieten die Möglichkeit, genau anzugeben, von welchem Teil einer Seite oder von welchen Seiten wir den Text lesen möchten. Dies ist sehr nützlich, wenn es um standardisierte Formulare geht, und kann viel Zeit sparen und die Effizienz verbessern.

Um Beschnittregionen zu verwenden, müssen wir einen Systemverweis auf System.Drawing hinzufügen, damit wir das System.Drawing.Rectangle-Objekt verwenden können.

using IronOcr;

IronTesseract ocr = new IronTesseract();
using OcrInput input = new OcrInput();

// Dimensions are in pixel
var contentArea = new System.Drawing.Rectangle() { X = 215, Y = 1250, Height = 280, Width = 1335 };

input.LoadImage("document.png", contentArea);

OcrResult result = ocr.Read(input);
Console.WriteLine(result.Text);

OCR für Scans niedriger Qualität

Die IronOCR OcrInput-Klasse kann Scans korrigieren, die der normale Tesseract nicht lesen kann.

using IronOcr;

IronTesseract ocr = new IronTesseract();
using OcrInput input = new OcrInput();
var pageindices = new int[] { 1, 2 };
input.LoadImageFrames(@"img\Potter.tiff", pageindices);

// fixes digital noise and poor scanning
input.DeNoise();

// fixes rotation and perspective
input.Deskew();

OcrResult result = ocr.Read(input);
Console.WriteLine(result.Text);

OCR-Ergebnisse als durchsuchbare PDF-Datei exportieren

using IronOcr;

IronTesseract ocr = new IronTesseract();
using OcrInput input = new OcrInput();
input.Title = "Quarterly Report";
input.LoadImage("image1.jpeg");
input.LoadImage("image2.png");
var pageindices = new int[] { 1, 2 };
input.LoadImageFrames("image3.gif", pageindices);

OcrResult result = ocr.Read(input);
result.SaveAsSearchablePdf("searchable.pdf");

TIFF in durchsuchbares PDF konvertieren

using IronOcr;

IronTesseract ocr = new IronTesseract();
using OcrInput input = new OcrInput();
var pageindices = new int[] { 1, 2 };
input.LoadImageFrames("example.tiff", pageindices);
ocr.Read(input).SaveAsSearchablePdf("searchable.pdf");

OCR-Ergebnisse als HTML exportieren

using IronOcr;

IronTesseract ocr = new IronTesseract();
using OcrInput input = new OcrInput();
input.Title = "Html Title";
input.LoadImage("image1.jpeg");

OcrResult Result = ocr.Read(input);
Result.SaveAsHocrFile("results.html");

OCR-Filter zur Bildverbesserung

IronOCR bietet einzigartige Filter für OcrInput-Objekte, um die OCR-Leistung zu verbessern.

Bildverbesserungscode-Beispiel

using IronOcr;

IronTesseract ocr = new IronTesseract();
using OcrInput input = new OcrInput();
input.LoadImage("LowQuality.jpeg");

// fixes digital noise and poor scanning
input.DeNoise();

// fixes rotation and perspective
input.Deskew();

OcrResult result = ocr.Read(input);
Console.WriteLine(result.Text);

Liste von OCR-Bildfiltern

Zu den in IronOCR eingebauten Eingabefiltern zur Verbesserung der OCR-Leistung gehören:

  • OcrInput.Rotate(double degrees) - Dreht Bilder um eine bestimmte Anzahl von Grad im Uhrzeigersinn. Für eine Drehung gegen den Uhrzeigersinn verwenden Sie negative Zahlen.
  • OcrInput.Binarize() - Dieser Filter konvertiert jeden Pixel entweder in Schwarz oder Weiß ohne Zwischenstufen, was die OCR-Leistung bei Bildern mit sehr geringem Kontrast potenziell verbessern kann.
  • OcrInput.ToGrayScale() - Konvertiert jeden Pixel in einen Graustufenwert. Sie kann die Genauigkeit nicht verbessern, aber die Geschwindigkeit erhöhen.
  • OcrInput.Contrast() - Erhöht automatisch den Kontrast, verbessert oft die Geschwindigkeit und Genauigkeit bei Scans mit geringem Kontrast.
  • OcrInput.DeNoise() - Entfernt digitales Rauschen, empfohlen nur, wenn Rauschen erwartet wird.
  • OcrInput.Invert() - Kehrt jede Farbe um (Weiß wird Schwarz und umgekehrt).
  • OcrInput.Dilate() - Erweitert die Morphologie, fügt Pixel zu Objektgrenzen hinzu, das Gegenteil von Erosion.
  • OcrInput.Erode() - Erweitert die Morphologie, entfernt Pixel von Objektgrenzen, das Gegenteil von Dilatation.
  • OcrInput.Deskew() - Dreht ein Bild, um es korrekt auszurichten. Nützlich, weil Tesseracts Schräglagentoleranz begrenzt ist.
  • OcrInput.EnhanceResolution - Verbessert die Auflösung von Bildern minderer Qualität. Diese Einstellung dient zur automatischen Verwaltung von Eingaben mit niedriger DPI.
  • EnhanceResolution erkennt Bilder mit niedriger Auflösung (unter 275 dpi), skaliert sie hoch und schärft Text für bessere OCR-Ergebnisse. Obwohl zeitaufwendig, reduziert es oft die gesamte OCR-Bearbeitungszeit.
  • Language - Unterstützt die Auswahl aus 22 internationalen Sprachpaketen.
  • Strategy - Ermöglicht die Auswahl zwischen schnellen und weniger genauen oder erweiterten Strategien (unter Verwendung von KI für Genauigkeit) basierend auf der statistischen Beziehung von Wörtern.
  • ColorSpace - Wählen Sie, ob OCR in Graustufen oder Farbe durchgeführt werden soll; graustufen sind im Allgemeinen optimal, obwohl Farbe in bestimmten Kontrastsituationen besser sein kann.
  • DetectWhiteTextOnDarkBackgrounds - Passt sich an negative Bilder an, erkennt und liest automatisch weißen Text auf dunklen Hintergründen.
  • InputImageType - Führt die OCR-Bibliothek, indem angegeben wird, ob an einem vollständigen Dokument oder einem Ausschnitt gearbeitet wird.
  • RotateAndStraighten - Ermöglicht es IronOCR, Dokumente korrekt zu handhaben, die gedreht oder durch Perspektivverzerrungen betroffen sind.
  • ReadBarcodes - Liest automatisch Barcodes und QR-Codes gleichzeitig mit dem Textscannen, ohne signifikant zusätzliche Zeit zu benötigen.
  • ColorDepth - Bestimmt die Bits pro Pixel für die Farbtiefe im OCR-Prozess. Eine größere Tiefe kann die Qualität, aber auch die Bearbeitungszeit erhöhen.

125 Sprachpakete

IronOCR unterstützt 125 internationale Sprachen über Sprachpakete, die als DLLs verteilt werden und zum Download von dieser Website oder über den NuGet Package Manager zur Verfügung stehen.

Zu den Sprachen gehören u. a. Deutsch, Französisch, Englisch, Chinesisch und Japanisch. Spezialisierte Sprachpakete gibt es für MRZ, MICR-Schecks, Finanzdaten, Nummernschilder usw. Darüber hinaus können kundenspezifische Tesseract ".traineddata"-Dateien verwendet werden.

Sprachbeispiel

using IronOcr;

// PM> Install IronOcr.Languages.Arabic
IronTesseract ocr = new IronTesseract();
ocr.Language = OcrLanguage.Arabic;

using OcrInput input = new OcrInput();

var pageindices = new int[] { 1, 2 };
input.LoadImageFrames("img/arabic.gif", pageindices);
// Add image filters if needed
// In this case, even thought input is very low quality
// IronTesseract can read what conventional Tesseract cannot.
OcrResult result = ocr.Read(input);
// Console can't print Arabic on Windows easily.
// Let's save to disk instead.
result.SaveAsTextFile("arabic.txt");

Beispiel für mehrere Sprachen

Es ist auch möglich, OCR in mehreren Sprachen gleichzeitig durchzuführen. Dies kann die OCR von englischen Metadaten und URLs in Unicode-Dokumenten verbessern.

using IronOcr;

// PM> Install IronOcr.Languages.ChineseSimplified
IronTesseract ocr = new IronTesseract();
ocr.Language = OcrLanguage.ChineseSimplified;

// We can add any number of languages
ocr.AddSecondaryLanguage(OcrLanguage.English);

using OcrInput input = new OcrInput();
input.LoadPdf("multi-language.pdf");
OcrResult result = ocr.Read(input);
result.SaveAsTextFile("results.txt");

Detaillierte OCR-Ergebnisobjekte

IronOCR gibt für jeden Vorgang ein OCR-Ergebnisobjekt zurück. Im Allgemeinen greifen Entwickler auf die Text-Eigenschaft zu, um gescannten Text zu erhalten. Das Ergebnisobjekt enthält jedoch viel detailliertere Informationen.

using IronOcr;

IronTesseract ocr = new IronTesseract();

// Must be set to true to read barcode
ocr.Configuration.ReadBarCodes = true;
using OcrInput input = new OcrInput();
var pageindices = new int[] { 1, 2 };
input.LoadImageFrames(@"img\sample.tiff", pageindices);

OcrResult result = ocr.Read(input);
var pages = result.Pages;
var words = pages[0].Words;
var barcodes = result.Barcodes;
// Explore here to find a massive, detailed API:
// - Pages, Blocks, Paraphaphs, Lines, Words, Chars
// - Image Export, Fonts Coordinates, Statistical Data, Tables

Leistung

IronOCR ist sofort einsatzbereit und erfordert keine Leistungsanpassung oder Image-Modifikation.

Die Geschwindigkeit ist atemberaubend: IronOCR.2020+ ist bis zu 10-mal schneller und macht über 250 % weniger Fehler als frühere Versionen.

Mehr erfahren

Wenn Sie mehr über OCR in C#, VB, F# oder einer anderen .NET-Sprache erfahren möchten, lesen Sie bitte unsere Community-Tutorials, die praktische Beispiele für die Verwendung von IronOCR und die Feinheiten der Optimierung der Bibliothek enthalten.

Eine vollständige API-Referenz for .NET-Entwickler ist ebenfalls verfügbar.

Curtis Chau
Technischer Autor

Curtis Chau hat einen Bachelor-Abschluss in Informatik von der Carleton University und ist spezialisiert auf Frontend-Entwicklung mit Expertise in Node.js, TypeScript, JavaScript und React. Leidenschaftlich widmet er sich der Erstellung intuitiver und ästhetisch ansprechender Benutzerschnittstellen und arbeitet gerne mit modernen Frameworks sowie der Erstellung gut strukturierter, optisch ansprechender Handbücher.

...
Weiterlesen

Bereit anzufangen?

Nuget Downloads 6,236,385Version:2026.9gerade veröffentlicht

Erhalten Sie sofort Ihren kostenlosen 30-Tage-Testschlüssel.
Ihr Testlizenzschlüssel wurde Ihnen per E-Mail gesendet.
C# NuGet-Bibliothek für PDF
Installation mit NuGet

Version: 2026.9

PM > Install-Package IronOcr
nuget.org/packages/IronOcr/
  1. Rechtsklick auf Referenzen, NuGet-Pakete verwalten
  2. Wählen Sie Durchsuchen und suchen Sie nach "IronOCR"
  3. Paket auswählen und installieren
C# PDF DLL
Download DLL

Version: 2026.9

oder laden Sie den Windows Installer hier herunter.

  1. Laden Sie IronOCR herunter und entpacken Sie es in einem Ordner wie ~/Libs in Ihrem Lösungsverzeichnis.
  2. Klicken Sie im Visual Studio Solution Explorer mit der rechten Maustaste auf Referenzen. Wählen Sie Durchsuchen, "IronOCR.dll"

Lizenzen von $999

Key in blue circle

Holen Sie sich sofort Ihren kostenlosen 30-Tage-Testschlüssel.

Your trial license will be sent to your email address

Keine Einschränkungen. 100 % freigeschaltet. Keine Kreditkarte.

bullet_checkedIhr Testlizenzschlüssel wurde Ihnen per E-Mail gesendet.Keine Einschränkungen. 100 % freigeschaltet. Keine Kreditkarte.
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried IronPDF
Erhalten Sie Ihre unverbindliche Beratung
Füllen Sie das Formular unten aus oder senden Sie eine E-Mail an sales@ironsoftware.com
Ihre Daten werden immer vertraulich behandelt.
Von Millionen von Ingenieur*innen weltweit vertraut
Kundenlogos von Iron Software
Erhalten Sie sofort Ihren kostenlosen 30-Tage-Testschlüssel.
Ihr Testlizenzschlüssel wurde Ihnen per E-Mail gesendet.