IRONSOFTWAREHOME

Mit IronOCR Leseergebnisse in C# extrahieren

Curtis Chau
Curtis Chau
Updated: 12. Mai 2026

Die Read Methode von IronOCR gibt ein OcrResult-Objekt zurück, das extrahierten Text plus detaillierte Metadaten einschließlich präziser Koordinaten, Abmessungen, Textrichtung und hierarchischer Struktur (Absätze, Zeilen, Wörter, Zeichen) für jedes erkannte Element enthält.

Das OCR-Ergebnis enthält umfassende Informationen über erkannte Absätze, Zeilen, Wörter und einzelne Zeichen.

Für jedes Element bietet es den Textinhalt, präzise X- und Y-Koordinaten, Abmessungen (Breite und Höhe), Textrichtung (von links nach rechts oder von oben nach unten) und den Standort in einem CropRectangle Objekt.

Schnellstart: Worttext vom ersten erkannten Wort abrufen

Verwenden Sie IronTesseract's Read Methode, um ein Bild zu OCRen und den Text des ersten Wortes mit der Words-Sammlung zu extrahieren.

  1. 1Install IronOCR with NuGet Package Manager

    PM > Install-Package IronOcr

  2. 2Kopieren Sie diesen Codeausschnitt und führen Sie ihn aus.

    string wordText = new IronTesseract().Read("file.jpg").Words[0].Text;
    C#
  3. 3Bereitstellen zum Testen in Ihrer Live-Umgebung

    Beginnen Sie noch heute, IronOCR in Ihrem Projekt zu verwenden, mit einer kostenlosen Testversion
    arrow pointer

Welche Daten kann ich aus OCR-Ergebnissen extrahieren?

Der Ergebniswert enthält nicht nur den extrahierten Text, sondern auch Informationen über Seiten, Absätze, Zeilen, Wörter, Zeichen und Barcodes, die IronOcr in PDF- und Bilddokumenten entdeckt hat. Sie können auf diese Informationen aus dem zurückgegebenen OcrResult-Objekt mithilfe der Read Methode zugreifen.

Das umfassende Ergebnissystem von IronOCR baut auf der leistungsstarken Tesseract 5-Engine auf und bietet Entwicklern über die einfache Texterkennung hinausgehende Möglichkeiten zur Extraktion strukturierter Daten. Ob Sie gescannte Dokumente, Fotos oder Screenshots verarbeiten, die OcrResult Klasse gibt Ihnen granularen Zugriff auf die extrahierten Daten.

using IronOcr;
using System;
using static IronOcr.OcrResult;

// Instantiate IronTesseract
IronTesseract ocrTesseract = new IronTesseract();

// Add image
using var imageInput = new OcrImageInput("sample.jpg");
// Perform OCR
OcrResult ocrResult = ocrTesseract.Read(imageInput);

// Retrieve list of detected paragraphs
Paragraph[] paragraphs = ocrResult.Paragraphs;

// Output information to console
Console.WriteLine($"Text: {paragraphs[0].Text}");
Console.WriteLine($"X: {paragraphs[0].X}");
Console.WriteLine($"Y: {paragraphs[0].Y}");
Console.WriteLine($"Width: {paragraphs[0].Width}");
Console.WriteLine($"Height: {paragraphs[0].Height}");
Console.WriteLine($"Text direction: {paragraphs[0].TextDirection}");
Visual Studio-Debugger mit OCR-Extraktionsergebnissen mit Koordinaten und Text aus einem japanischen Geschäftsdokument

Wie greife ich auf Textinhalte aus OCR-Ergebnissen zu?

Das OcrResult-Objekt präsentiert den extrahierten Text auf eine einfache, intuitive Weise, was es Entwicklern ermöglicht, ihn direkt zu verwenden oder in andere Anwendungsbestandteile zu integrieren. Die hierarchische Struktur spiegelt die natürliche Textorganisation eines Dokuments wider und macht es einfach, mit Inhalten auf verschiedenen Granularitätsebenen zu arbeiten.

Für Anwendungen, die Mehrsprachenunterstützung erfordern, verarbeitet IronOCR nahtlos mehrsprachige Dokumente, wobei das gleiche strukturierte Ergebnisformat für alle 125 unterstützten Sprachen beibehalten wird.

Das folgende Codebeispiel druckt Text in einer Schleife, um die Ergebnisse zu überprüfen.

using IronOcr;
using System;
using static IronOcr.OcrResult;

// Instantiate IronTesseract
IronTesseract ocrTesseract = new IronTesseract();

// Add image
using var imageInput = new OcrImageInput("sampleText.png");
// Perform OCR
OcrResult ocrResult = ocrTesseract.Read(imageInput);

// Retrieve list of detected paragraphs
Paragraph[] paragraphs = ocrResult.Paragraphs;

// Loop through each paragraph in the array
Console.WriteLine("--- All Detected Paragraphs ---");
foreach (Paragraph paragraph in paragraphs)
{
    // Print the text of the current paragraph
    Console.WriteLine(paragraph.Text);

    // Add a blank line for better separation (optional)
    Console.WriteLine();
}

Ausgabe

Terminal zur Anzeige der OCR-Absatzerkennungsergebnisse mit extrahiertem Text über Masayoshi Son und Yasumitsu Shigeta

Die Konsolenausgabe zeigt, wie IronOCR den Absatztext zeilenweise und präzise extrahiert. Die Engine erkennt automatisch Absatzgrenzen und ist daher ideal für die Bearbeitung komplexer Dokumente mit mehreren Textblöcken.

Wie erhalte ich die Ortskoordinaten von erkanntem Text?

Neben dem extrahierten Text bietet OcrResult detaillierte Standortdaten. Diese räumlichen Informationen sind von entscheidender Bedeutung für Anwendungen, die die Layouttreue beibehalten oder eine gezielte Textextraktion aus bestimmten Dokumentenbereichen durchführen müssen. Das Koordinatensystem verwendet Standard-Pixelmaße von der linken oberen Ecke der Seite aus.

Um die Präzision koordinatenbasierter Operationen zu verbessern, sollten Sie OCR region targeting verwenden, um sich auf bestimmte Bereiche zu konzentrieren, oder Computer Vision capabilities nutzen, um Textbereiche automatisch zu identifizieren.

Der folgende Code demonstriert die Iteration über jeden Absatz und die Ausgabe seiner Koordinaten (X und Y) auf der Konsole.

using IronOcr;
using System;
using static IronOcr.OcrResult;

// Instantiate IronTesseract
IronTesseract ocrTesseract = new IronTesseract();

// Add image
using var imageInput = new OcrImageInput("sampleText.png");
// Perform OCR
OcrResult ocrResult = ocrTesseract.Read(imageInput);

// Retrieve list of detected paragraphs
Paragraph[] paragraphs = ocrResult.Paragraphs;

Console.WriteLine("--- All Detected Coordinates of Paragraphs ---");

// Use a 'for' loop to get an index for each paragraph
for (int i = 0; i < paragraphs.Length; i++)
{
    // Get the current paragraph
    Paragraph paragraph = paragraphs[i];

    // Print the paragraph number, text, and its location
    Console.WriteLine($"X: {paragraph.X}"); // X-coordinate (left edge)
    Console.WriteLine($"Y: {paragraph.Y}"); // Y-coordinate (top edge)

    // Add a blank line for better separation
    Console.WriteLine();
}

Ausgabe

Terminalausgabe mit den von OCR erkannten Absatzkoordinaten mit den X,Y-Werten: (29,30), (28,74) und (27,362)

Die Ausgabe zeigt drei Koordinatensätze an, die drei Absätzen entsprechen. Diese Koordinaten können zum Zeichnen von Begrenzungsrahmen (Bounding Boxes), zum Extrahieren bestimmter Regionen oder zum Beibehalten räumlicher Beziehungen zwischen Textelementen verwendet werden.

Welche anderen Attribute sind in OCR-Ergebnissen verfügbar?

Neben Text und Textkoordinaten bietet IronOCR zusätzliche Informationen. Für jedes Textelement (Absätze, Zeilen, Wörter und einzelne Zeichen) sind die folgenden Informationen verfügbar:

  • Text: Der eigentliche Text als Zeichenfolge.
  • X: Die Position vom linken Seitenrand in Pixeln.
  • Y: Die Position vom oberen Rand der Seite in Pixeln.
  • Breite: Die Breite in Pixeln.
  • Höhe: Die Höhe in Pixeln.
  • Textrichtung: Die Richtung, in der der Text gelesen wurde (von links nach rechts oder von oben nach unten).
  • Position: Ein Rechteck, das in Pixeln angibt, wo sich dieser Text auf der Seite befindet.

Diese Eigenschaften sind besonders bei der Implementierung nützlich:

  • Texthervorhebung und Anmerkungssysteme
  • Automatisierte Erkennung von Formularfeldern
  • Layout-Erhaltung bei der Konvertierung von Dokumenten
  • Räumliche Textanalyse zur Datenextraktion

Verwenden Sie zur Fehlersuche und Visualisierung die Funktion Texte hervorheben, um die Genauigkeit der erkannten Region visuell zu überprüfen.

Wie werden Absätze, Zeilen, Wörter und Zeichen verglichen?

Die hierarchische Textstruktur von IronOCR ermöglicht es Entwicklern, auf der für ihren spezifischen Anwendungsfall geeigneten Detailebene zu arbeiten. Das Verständnis der Unterschiede zwischen diesen Elementen hilft dabei, die richtige Granularität für Ihre Anwendung zu wählen.

Im Folgenden finden Sie einen Vergleich der gefundenen Absätze, Zeilen, Wörter und Zeichen.

Hervorgehobene biografische Profile der japanischen Tech-Unternehmer Masayoshi Son und Yasumitsu Shigeta
Rot hervorgehobenes Dokument mit den Profilen der japanischen Tech-Führungskräfte Masayoshi Son und Yasumitsu Shigeta
Texthervorhebungsfunktion mit roten Kästen, die ausgewählte Wörter in einem Absatz über technische Investitionen überlagern
Texterkennung auf Zeichenebene mit Anzeige einzelner Zeichengrenzen in OCR-Ergebnissen

Jede Granularitätsebene dient unterschiedlichen Zwecken:

  • Absatzen: Am besten geeignet für die Analyse der Dokumentstruktur und die Extraktion von Massentext
  • Zeilen: Nützlich für die Einhaltung der Lesereihenfolge und die Verarbeitung von Tabellendaten
  • Wörter: Ideal für Suchfunktionen und Textanalyse
  • Zeichen: Perfekt für die Rechtschreibprüfung und präzise Textbearbeitungsanwendungen

Kann IronOCR BarCodes und QR-Codes lesen?

Ja, IronOCR kann Barcodes und QR-Codes lesen. Obwohl das Feature möglicherweise nicht so robust ist wie IronBarcode, bietet IronOCR Unterstützung für gängige Barcode-Typen. Um die Barcode-Erkennung zu aktivieren, setzen Sie die Configuration.ReadBarCodes Eigenschaft auf true. Diese integrierte Funktionalität macht IronOCR zu einer ausgezeichneten Wahl für die Bearbeitung von Dokumenten, die sowohl Text als auch Strichcodes enthalten, wie z. B. Rechnungen, Versandetiketten oder Produktkataloge.

Zusätzlich können aus erkannten Barcodes wertvolle Informationen extrahiert werden, einschließlich Format, Wert, Koordinaten (x, y), Höhe, Breite und Standort als IronSoftware.Drawing.Rectangle-Objekt. Diese Rectangle-Klasse in IronDrawing ermöglicht eine präzise Positionierung im Dokument.

Für fortgeschrittene Barcode-Leseszenarien finden Sie in unserer Dokumentation umfassende Barcode-Lesebeispiele.

using IronOcr;
using System;
using static IronOcr.OcrResult;

// Instantiate IronTesseract
IronTesseract ocrTesseract = new IronTesseract();

// Enable barcodes detection
ocrTesseract.Configuration.ReadBarCodes = true;

// Add image
using OcrInput ocrInput = new OcrInput();
ocrInput.LoadPdf("sample.pdf");

// Perform OCR
OcrResult ocrResult = ocrTesseract.Read(ocrInput);

// Output information to console
foreach(var barcode in ocrResult.Barcodes)
{
    Console.WriteLine("Format = " + barcode.Format);
    Console.WriteLine("Value = " + barcode.Value);
    Console.WriteLine("X = " + barcode.X);
    Console.WriteLine("Y = " + barcode.Y);
}
Console.WriteLine(ocrResult.Text);

Wie sieht die Ausgabe der Barcode-Erkennung aus?

Die Barcode-Erkennungsfunktion in IronOCR ist nahtlos in die Textextraktion integriert und liefert einheitliche Ergebnisse, die sowohl Textinhalte als auch Barcodedaten enthalten. Diese doppelte Fähigkeit ist wertvoll für automatisierte Dokumentenverarbeitungs-Workflows, bei denen beide Informationstypen extrahiert und korreliert werden müssen.

Debug-Konsole, die die Ergebnisse der Erkennung von QR-Codes und EAN8-Barcodes mit Formaten, Werten und Koordinaten anzeigt

Die Ausgabe demonstriert die Fähigkeit von IronOCR, mehrere Barcodetypen gleichzeitig zu erkennen und liefert eine Formatidentifikation (wie QRCode oder EAN8), dekodierte Werte und präzise Koordinateninformationen für jeden erkannten Code. Diese umfassenden Daten ermöglichen es Entwicklern, anspruchsvolle Dokumentenverarbeitungsanwendungen zu erstellen, die gemischte Inhaltstypen effizient verarbeiten.

Häufig gestellte Fragen

Welche Informationen enthält das OcrResult-Objekt?

Das OcrResult-Objekt von IronOCR enthält den extrahierten Text plus detaillierte Metadaten, einschließlich genauer X/Y-Koordinaten, Abmessungen (Breite und Höhe), Textrichtung (von links nach rechts oder von oben nach unten) und hierarchischer Struktur, die als Absätze, Zeilen, Wörter und einzelne Zeichen für jedes erkannte Element organisiert ist.

Wie kann ich schnell das erste Wort aus einem OCR-Ergebnis extrahieren?

Sie können den Text des ersten Worts mithilfe der Read-Methode von IronOCR und dem Zugriff auf die Words-Sammlung extrahieren: `string wordText = new IronTesseract().Read("file.jpg").Words[0].Text;`. Dies ermöglicht den sofortigen Zugriff auf einzelne Wortelemente aus den OCR-Ergebnissen.

Welche Arten von Koordinatendaten sind in OCR-Ergebnissen verfügbar?

IronOCR liefert präzise X- und Y-Koordinaten für jedes erkannte Element (Absätze, Zeilen, Wörter und Zeichen), zusammen mit Breiten- und Höhenmaßen. Auf diese Koordinatendaten kann über das CropRectangle-Objekt zugegriffen werden, so dass eine genaue Standortverfolgung von Textelementen möglich ist.

Kann ich Metadaten über den reinen Textinhalt hinaus extrahieren?

Ja, IronOCR extrahiert umfassende Metadaten, einschließlich Seiten, Absätze, Zeilen, Wörter, Zeichen und sogar Barcodes, die in PDF- und Bilddokumenten entdeckt wurden. Das OcrResult-Objekt ermöglicht den Zugriff auf Textrichtung, hierarchische Struktur und räumliche Informationen für jedes Element.

Welche Dokumenttypen können für OCR-Ergebnisse verarbeitet werden?

IronOCR kann verschiedene Dokumenttypen verarbeiten, darunter gescannte Dokumente, Fotos, Screenshots, PDFs und Bilddateien. Die Lesemethode funktioniert bei all diesen Formaten einheitlich und gibt dasselbe strukturierte OcrResult-Objekt mit allen Metadaten zurück.

Wie ist der extrahierte Text in den Ergebnissen angeordnet?

IronOCR organisiert den extrahierten Text in einer hierarchischen Struktur, die die natürliche Organisation von Dokumenten widerspiegelt. Das OcrResult-Objekt stellt Inhalte auf verschiedenen Granularitätsebenen dar - von ganzen Seiten bis hin zu einzelnen Zeichen - und erleichtert so die Arbeit mit Text auf der für Ihre Anwendung geeigneten Ebene.

Can IronOCR read barcodes and QR codes?

Yes, IronOCR can read common barcode types, including QR codes, by enabling barcode detection in the configuration. This integration allows for comprehensive processing of documents containing both text and barcodes.

How does IronOCR help with hierarchical text analysis?

IronOCR's hierarchical text structure allows developers to work at different granularity levels, such as paragraphs, lines, words, and characters, making it suitable for various applications like document structure analysis and text search functionality.

What advanced features does IronOCR offer for coordinate-based operations?

IronOCR offers OCR region targeting for focused text extraction and Computer Vision capabilities to automatically identify text regions, enhancing precision in coordinate-based applications.

What does the barcode detection output look like in IronOCR?

The barcode detection output in IronOCR includes format identification, decoded values, and precise coordinates, seamlessly integrated with text extraction for efficient processing of mixed content documents.

Curtis Chau
Technischer Autor

Curtis Chau hat einen Bachelor-Abschluss in Informatik von der Carleton University und ist spezialisiert auf Frontend-Entwicklung mit Expertise in Node.js, TypeScript, JavaScript und React. Leidenschaftlich widmet er sich der Erstellung intuitiver und ästhetisch ansprechender Benutzerschnittstellen und arbeitet gerne mit modernen Frameworks sowie der Erstellung gut strukturierter, optisch ansprechender Handbücher.

...
Weiterlesen

Bereit anzufangen?

Nuget Downloads 6,236,385Version:2026.9gerade veröffentlicht

Erhalten Sie sofort Ihren kostenlosen 30-Tage-Testschlüssel.
Ihr Testlizenzschlüssel wurde Ihnen per E-Mail gesendet.
C# NuGet-Bibliothek für PDF
Installation mit NuGet

Version: 2026.9

PM > Install-Package IronOcr
nuget.org/packages/IronOcr/
  1. Rechtsklick auf Referenzen, NuGet-Pakete verwalten
  2. Wählen Sie Durchsuchen und suchen Sie nach "IronOCR"
  3. Paket auswählen und installieren
C# PDF DLL
Download DLL

Version: 2026.9

oder laden Sie den Windows Installer hier herunter.

  1. Laden Sie IronOCR herunter und entpacken Sie es in einem Ordner wie ~/Libs in Ihrem Lösungsverzeichnis.
  2. Klicken Sie im Visual Studio Solution Explorer mit der rechten Maustaste auf Referenzen. Wählen Sie Durchsuchen, "IronOCR.dll"

Lizenzen von $999

Key in blue circle

Holen Sie sich sofort Ihren kostenlosen 30-Tage-Testschlüssel.

Your trial license will be sent to your email address

Keine Einschränkungen. 100 % freigeschaltet. Keine Kreditkarte.

bullet_checkedIhr Testlizenzschlüssel wurde Ihnen per E-Mail gesendet.Keine Einschränkungen. 100 % freigeschaltet. Keine Kreditkarte.
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried IronPDF
Erhalten Sie Ihre unverbindliche Beratung
Füllen Sie das Formular unten aus oder senden Sie eine E-Mail an sales@ironsoftware.com
Ihre Daten werden immer vertraulich behandelt.
Von Millionen von Ingenieur*innen weltweit vertraut
Kundenlogos von Iron Software
Erhalten Sie sofort Ihren kostenlosen 30-Tage-Testschlüssel.
Ihr Testlizenzschlüssel wurde Ihnen per E-Mail gesendet.