OCR-Ergebnisse
Erhalten Sie mehr als nur Text. Unsere API bietet strukturierte Daten wie Koordinaten, Konfidenzwerte und eine vollständige Dokumenthierarchie (Seiten, Zeilen, Wörter).
Datenausgabe
Texte
IronOCR gibt die Textausgabe für Absätze, Zeilen, Wörter und Zeichen als strukturierte Objekte und Zeichenketten zurück, so dass Entwickler schnell auf die Daten zugreifen und sie manipulieren können.
using IronOcr;
var ocrTesseract = new IronTesseract();
using var ocrInput = new OcrInput();
var pages = new int[] { 1, 2 };
ocrInput.LoadImageFrames("example.tiff", pages);
OcrResult ocrResult = ocrTesseract.Read(ocrInput);
foreach (var page in ocrResult.Pages)
{
// Page text
string PageText = page.Text;
}Imports IronOcr
Dim ocrTesseract As New IronTesseract()
Using ocrInput As New OcrInput()
Dim pages As Integer() = {1, 2}
ocrInput.LoadImageFrames("example.tiff", pages)
Dim ocrResult As OcrResult = ocrTesseract.Read(ocrInput)
For Each page In ocrResult.Pages
' Page text
Dim PageText As String = page.Text
Next
End UsingOCR-Texte Standort
Erhalten Sie die exakten X/Y-Koordinaten und Bounding-Box-Abmessungen für jeden Absatz, jede Zeile, jedes Wort und jedes Zeichen und ermöglichen Sie so Texthervorhebung, zonale OCR und Datenvalidierung.
Erfahren Sie, wie man:Leseergebnisse in .NET C# extrahiertusing IronOcr;
using IronOcr.OcrResult;
// Instantiate IronTesseract
IronTesseract ocrTesseract = new IronTesseract();
// Add image
using var imageInput = new OcrImageInput("sample.jpg");
// Perform OCR
OcrResult ocrResult = ocrTesseract.Read(imageInput);
// Retrieve list of detected paragraphs
Paragraph[] paragraphs = ocrResult.Paragraphs;
// Output Text location (X,Y) of the first paragraph
Console.WriteLine($"X: {paragraphs[0].X}");
Console.WriteLine($"Y: {paragraphs[0].Y}");Imports IronOcr
Imports IronOcr.OcrResult
' Instantiate IronTesseract
Dim ocrTesseract As New IronTesseract()
' Add image
Using imageInput As New OcrImageInput("sample.jpg")
' Perform OCR
Dim ocrResult As OcrResult = ocrTesseract.Read(imageInput)
' Retrieve list of detected paragraphs
Dim paragraphs() As Paragraph = ocrResult.Paragraphs
' Output Text location (X,Y) of the first paragraph
Console.WriteLine($"X: {paragraphs(0).X}")
Console.WriteLine($"Y: {paragraphs(0).Y}")
End UsingOCR Output Vertrauen
Sie erhalten einen Konfidenzwert für die extrahierten Texte. Programmgesteuertes Markieren von Ergebnissen mit geringer Konfidenz zur Überprüfung durch einen Menschen, um zuverlässigere Automatisierungsworkflows zu erstellen.
Erfahren Sie, wie Sie:Lesesicherheit in .NET C# erhaltenusing IronOcr;
var ocrTesseract = new IronTesseract();
using var ocrInput = new OcrInput();
// Load image from file
ocrInput.LoadImage("sameple.png");
// Perform OCR
OcrResult ocrResult = ocrTesseract.Read(ocrInput);
// Check Confidence level
Console.WriteLine($"Confidence: {ocrResult.Confidence}%");Imports IronOcr
Dim ocrTesseract = New IronTesseract()
Using ocrInput = New OcrInput()
' Load image from file
ocrInput.LoadImage("sameple.png")
' Perform OCR
Dim ocrResult As OcrResult = ocrTesseract.Read(ocrInput)
' Check Confidence level
Console.WriteLine($"Confidence: {ocrResult.Confidence}%")
End UsingBilder von OCR-Elementen
Zusätzlich zum Text können Sie visuelle Elemente von Texten, die durch OCR aus dem Eingabedokument erkannt wurden, als separate Bilddateien exportieren, was für die Archivierung oder Verarbeitung von nicht-textlichen Daten nützlich ist.
Erfahren Sie, wie man:Leseergebnisse in .NET C# extrahiertusing IronOcr;
using IronSoftware.Drawing;
var ocrTesseract = new IronTesseract();
using var ocrInput = new OcrInput();
ocrInput.LoadImage("sample.png");
var ocrResult = ocrTesseract.Read(ocrInput);
foreach (var page in ocrResult.Pages)
{
foreach (var word in page.Words)
{
word.ToBitmap(ocrInput).SaveAs($"page{page.PageNumber}_word{word.WordNumber}.png", AnyBitmap.ImageFormat.Png);
}
}Imports IronOcr
Imports IronSoftware.Drawing
Dim ocrTesseract = New IronTesseract()
Using ocrInput = New OcrInput()
ocrInput.LoadImage("sample.png")
Dim ocrResult = ocrTesseract.Read(ocrInput)
For Each page In ocrResult.Pages
For Each word In page.Words
word.ToBitmap(ocrInput).SaveAs($"page{page.PageNumber}_word{word.WordNumber}.png", AnyBitmap.ImageFormat.Png)
Next
Next
End Using
Output-Typen
Text
Zugriff auf die OCR-Ergebnisse über eine strukturierte, hierarchische API. Navigieren Sie mühelos von großen Absätzen bis hinunter zu einzelnen Zeichen, so dass Sie den extrahierten Text und seine Metadaten genauestens kontrollieren können.
Erfahren Sie, wie man:Leseergebnisse in .NET C# extrahiertusing IronOcr;
// Instantiate IronTesseract
IronTesseract ocrTesseract = new IronTesseract();
// Add image
using var imageInput = new OcrImageInput("sample.jpg");
// Perform OCR
OcrResult ocrResult = ocrTesseract.Read(imageInput);
// Output the first detected paragraph text
Console.WriteLine($"Text: {ocrResult.Paragraphs[0].Text}");Imports IronOcr
' Instantiate IronTesseract
Dim ocrTesseract As New IronTesseract()
' Add image
Using imageInput As New OcrImageInput("sample.jpg")
' Perform OCR
Dim ocrResult As OcrResult = ocrTesseract.Read(imageInput)
' Output the first detected paragraph text
Console.WriteLine($"Text: {ocrResult.Paragraphs(0).Text}")
End UsingDurchsuchbare PDFs
Konvertieren Sie jedes gescannte Dokument oder Bild in eine vollständig durchsuchbare PDF-Datei. Das ursprüngliche Layout bleibt erhalten, aber der gesamte Text wird auswählbar, kopierbar und durchsuchbar.
Erfahren Sie, wie Sie:Ergebnisse als durchsuchbare PDF-Datei speichernusing IronOcr;
// Instantiate IronTesseract
IronTesseract ocrTesseract = new IronTesseract();
// Enable render as searchable PDF
ocrTesseract.Configuration.RenderSearchablePdf = true;
// Add image
using var imageInput = new OcrImageInput("sample.tiff");
// Perform OCR
OcrResult ocrResult = ocrTesseract.Read(imageInput);
// Export as searchable PDF
ocrResult.SaveAsSearchablePdf("searchablePdf.pdf");Imports IronOcr
' Instantiate IronTesseract
Dim ocrTesseract As New IronTesseract()
' Enable render as searchable PDF
ocrTesseract.Configuration.RenderSearchablePdf = True
' Add image
Using imageInput As New OcrImageInput("sample.tiff")
' Perform OCR
Dim ocrResult As OcrResult = ocrTesseract.Read(imageInput)
' Export as searchable PDF
ocrResult.SaveAsSearchablePdf("searchablePdf.pdf")
End UsinghOCR
Die Ergebnisse werden im hOCR-Format exportiert, einem HTML-basierten Standard, der umfangreiche Metadaten, einschließlich Text, Layoutinformationen und Koordinaten für jedes Wort, bereitstellt und sich ideal für die erweiterte Dokumentenanalyse eignet.
Erfahren Sie, wie Sie:Ergebnisse als hOCR in einer HTML-Datei speichernusing IronOcr;
// Instantiate IronTesseract
IronTesseract ocrTesseract = new IronTesseract();
// Enable render as hOCR
ocrTesseract.Configuration.RenderHocr = true;
// Add image
using var imageInput = new OcrImageInput("sample.tiff");
imageInput.Title = "Html Title";
// Perform OCR
OcrResult ocrResult = ocrTesseract.Read(imageInput);
// Export as HTML
ocrResult.SaveAsHocrFile("result.html");Imports IronOcr
' Instantiate IronTesseract
Dim ocrTesseract As New IronTesseract()
' Enable render as hOCR
ocrTesseract.Configuration.RenderHocr = True
' Add image
Using imageInput As New OcrImageInput("sample.tiff")
imageInput.Title = "Html Title"
' Perform OCR
Dim ocrResult As OcrResult = ocrTesseract.Read(imageInput)
' Export as HTML
ocrResult.SaveAsHocrFile("result.html")
End UsingTexte als Bilder hervorheben
Zur Fehlersuche und Überprüfung erstellen Sie ein Bild des Originaldokuments, in dem der erkannte Text hervorgehoben ist. Dies ermöglicht eine schnelle visuelle Überprüfung der Genauigkeit der OCR-Engine und der Textposition.
Lernen Sie, wie man:C# Texte für die Fehlersuche hervorhebtusing IronOcr;
IronTesseract ocrTesseract = new IronTesseract();
using var ocrInput = new OcrInput();
ocrInput.LoadPdf("sample.pdf");
ocrInput.HighlightTextAndSaveAsImages(ocrTesseract, "highlight_page_", ResultHighlightType.Paragraph);Imports IronOcr
Dim ocrTesseract As New IronTesseract()
Using ocrInput As New OcrInput()
ocrInput.LoadPdf("sample.pdf")
ocrInput.HighlightTextAndSaveAsImages(ocrTesseract, "highlight_page_", ResultHighlightType.Paragraph)
End UsingBarCode- und QR-Code-Werte
Extrahieren Sie die dekodierten String-Werte von BarCodes oder QR-Codes, die sich im Dokument befinden. Die API liefert diese Daten zusammen mit den Textergebnissen für eine vollständige Datenerfassungslösung.
Erfahren Sie, wie man:Leseergebnisse in .NET C# extrahiertusing IronOcr;
using IronOcr.OcrResult;
// Instantiate IronTesseract
IronTesseract ocrTesseract = new IronTesseract();
// Enable barcodes detection
ocrTesseract.Configuration.ReadBarCodes = true;
// Load PDF file
using OcrInput ocrInput = new OcrInput();
ocrInput.LoadPdf("sample.pdf");
// Perform OCR
OcrResult ocrResult = ocrTesseract.Read(ocrInput);
// Output Barcode value
Console.WriteLine(ocrResult.Barcodes[0].Value);Imports IronOcr
Imports IronOcr.OcrResult
' Instantiate IronTesseract
Dim ocrTesseract As New IronTesseract()
' Enable barcodes detection
ocrTesseract.Configuration.ReadBarCodes = True
' Load PDF file
Using ocrInput As New OcrInput()
ocrInput.LoadPdf("sample.pdf")
' Perform OCR
Dim ocrResult As OcrResult = ocrTesseract.Read(ocrInput)
' Output Barcode value
Console.WriteLine(ocrResult.Barcodes(0).Value)
End UsingBereit anzufangen?
Nuget Downloads 6,236,385|Version:2026.9gerade veröffentlicht