<meta http-equiv="content-language" content="el" />
<h1>Ελληνικό αλφάβητο OCR σε C# και .NET</h1>
<h6>Άλλες εκδόσεις αυτού του εγγράφου:</h6>
<ul>
<li><a rel='alternate' hreflang='en' href="/csharp/ocr/languages/greek/">Αγγλικά (This Page in English)</a></li>
<li><a href="/csharp/ocr/languages/">Περισσότερα Languages</a></li>
</ul>
<p>Το IronOCR είναι ένα στοιχείο λογισμικού C# που επιτρέπει στους .NET κωδικοποιητές να διαβάζουν κείμενο από εικόνες και έγγραφα PDF σε 126 γλώσσες, συμπεριλαμβανομένου του Ελληνικού Αλφαβήτου.</p>
<p>Πρόκειται για ένα προηγμένο πιρούνι του Tesseract, κατασκευασμένο αποκλειστικά για τους προγραμματιστές .NET και ξεπερνά τακτικά άλλους κινητήρες Tesseract για ταχύτητα και ακρίβεια.</p>
<h2>Περιεχόμενα του IronOcr.Languages.Greek</h2>
<p>Αυτό το πακέτο περιέχει 102 γλώσσες OCR για .NET:</p>
<ul>
<li>Ελληνικά</li>
<li>GreekBest</li>
<li>GreekFast</li>
<li>Ελληνικό αλφάβητο</li>
<li>GreekAlphabetBest</li>
<li>GreekAlphabetFast</li>
</ul>
<h2>Κατεβάστε</h2>
<p>Πακέτο Ελληνικής Αλφαβήτου [Ελληνικά] <br/>
* Download as <a class='languages-dll' href='/csharp/ocr/packages/language-packs/Greek.ocrdata.zip'>Φερμουάρ <i class='fas fa-download'></i></a> <br/>
* Install with <a target='_blank' class='languages-nuget' href="https://www.nuget.org/packages/IronOcr.Languages.Greek/">https://www.nuget.org/packages/IronOcr.Languages.Greek/</a></p>
<h2>Εγκατάσταση</h2>
<p>Το πρώτο πράγμα που πρέπει να κάνουμε είναι να εγκαταστήσουμε το πακέτο μας <strong>Greek Alphabet</strong> OCR στο έργο σας .NET.</p>
<pre><code class="shell">PM> Install-Package IronOcr.Languages.Greek</code></pre>
<h2>Παράδειγμα κώδικα</h2>
<p>Αυτό το παράδειγμα κώδικα C# διαβάζει κείμενο ελληνικού αλφαβήτου από έγγραφο εικόνας ή PDF.</p>
```csharp
// Install the Greek language package using NuGet
// PM> Install-Package IronOcr.Languages.Greek
using IronOcr;
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Greek; // Set the OCR language to Greek
using (var Input = new OcrInput(@"images\Greek.png"))
{
var Result = Ocr.Read(Input); // Perform OCR on the input image
var AllText = Result.Text; // Get the extracted text
Console.WriteLine(AllText); // Print the extracted text
}
```
<h2>Γιατί να επιλέξετε IronOCR;</h2>
<p>Το IronOCR είναι μια εύκολη εγκατάσταση, πλήρης και καλά τεκμηριωμένη βιβλιοθήκη λογισμικού .NET.</p>
<p>Επιλέξτε IronOCR για να επιτύχετε <strong>99,8% + ακρίβεια OCR</strong> χωρίς να χρησιμοποιήσετε εξωτερικές υπηρεσίες ιστού, τρέχουσες χρεώσεις ή αποστολή εμπιστευτικών εγγράφων μέσω του Διαδικτύου.</p>
<h4>Γιατί οι προγραμματιστές C# επιλέγουν το IronOCR έναντι του Vanilla Tesseract:</h4>
<ul>
<li>Εγκατάσταση ως μεμονωμένο DLL ή NuGet</li>
<li>Περιλαμβάνει κινητήρες Tesseract 5, 4 και 3 εκτός κουτιού.</li>
<li>Η ακρίβεια <strong>99,8%</strong> ξεπερνά σημαντικά το κανονικό Tesseract.</li>
<li>Blazing Speed και MultiThreading</li>
<li>MVC, WebApp, Desktop, Console & Server Application συμβατό</li>
<li>Δεν υπάρχει κωδικός Exes ή C ++ για εργασία</li>
<li>Πλήρης υποστήριξη PDF OCR</li>
<li>Για να εκτελέσετε OCR σχεδόν οποιοδήποτε αρχείο εικόνας ή PDF</li>
<li>Πλήρης υποστήριξη .NET Core, Standard και FrameWork</li>
<li>Ανάπτυξη σε Windows, Mac, Linux, Azure, Docker, Lambda, AWS</li>
<li>Διαβάστε γραμμωτούς κώδικες και κωδικούς QR</li>
<li>Εξαγωγή OCR ως XHTML</li>
<li>Εξαγωγή OCR σε έγγραφα PDF με δυνατότητα αναζήτησης</li>
<li>Υποστήριξη πολλαπλών νημάτων</li>
<li>126 διεθνείς γλώσσες διαχειρίζονται όλες μέσω αρχείων NuGet ή OcrData</li>
<li>Εξαγωγή εικόνων, συντεταγμένων, στατιστικών και γραμματοσειρών. Όχι μόνο κείμενο.</li>
<li>Μπορεί να χρησιμοποιηθεί για την αναδιανομή του Tesseract OCR σε εμπορικές και ιδιόκτητες εφαρμογές.</li>
</ul>
<p><em>Το IronOCR λάμπει όταν εργάζεστε με εικόνες πραγματικού κόσμου και ατελή έγγραφα όπως φωτογραφίες ή σαρώσεις χαμηλής ανάλυσης που ενδέχεται να έχουν ψηφιακό θόρυβο ή ατέλειες.</em></p>
<p>Άλλες <a href="/csharp/ocr/use-case/free-ocr-csharp/">δωρεάν</a> βιβλιοθήκες <a href="/csharp/ocr/use-case/free-ocr-csharp/">OCR</a> για την πλατφόρμα .NET όπως άλλες .NET Tesseract APIs και υπηρεσίες ιστού δεν αποδίδουν τόσο καλά σε αυτές τις περιπτώσεις χρήσης του πραγματικού κόσμου.</p>
<h2>OCR με Tesseract 5 - Ξεκινήστε την κωδικοποίηση σε C#</h2>
<p>Το παρακάτω δείγμα κώδικα δείχνει πόσο εύκολο είναι να διαβάσετε κείμενο από μια εικόνα χρησιμοποιώντας C# ή VB .NET.</p>
<h3>OneLiner</h3>
```csharp
var Text = new IronTesseract().Read(@"img\Screenshot.png").Text;
// One line of code to perform OCR and retrieve text from a PNG image.
```
<h3>Διαμορφώσιμο Hello World</h3>
```csharp
// PM> Install-Package IronOcr.Languages.Greek
using IronOcr;
// Initialize the OCR engine
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Greek; // Set the language to Greek
using (var Input = new OcrInput())
{
Input.AddImage("images/sample.jpeg"); // Add an image to the OCR input
// ... μπορείτε να προσθέσετε οποιονδήποτε αριθμό εικόνων
var Result = Ocr.Read(Input); // Perform OCR on the input
Console.WriteLine(Result.Text); // Output the text
}
```
<h3>C# PDF OCR</h3>
<p>Η ίδια προσέγγιση μπορεί ομοίως να χρησιμοποιηθεί για την εξαγωγή κειμένου από οποιοδήποτε έγγραφο PDF.</p>
```csharp
using IronOcr;
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Greek; // Set the language to Greek
using (var input = new OcrInput())
{
// Add a PDF for OCR; optionally set a password if needed
input.AddPdf("example.pdf", "password");
// Μπορούμε επίσης να επιλέξουμε συγκεκριμένους αριθμούς σελίδων PDF στο OCR
var Result = Ocr.Read(input); // Read the OCR results
// Output the text and the number of pages processed
Console.WriteLine(Result.Text);
Console.WriteLine($"{Result.Pages.Count} Pages");
// 1 σελίδα για κάθε σελίδα του PDF
}
```
<h3>OCR για TIFF πολλαπλών σελίδων</h3>
<p>Μορφή αρχείου TIFF ανάγνωσης OCR που περιλαμβάνει έγγραφα πολλών σελίδων. Το TIFF μπορεί επίσης να μετατραπεί απευθείας σε αρχείο PDF με κείμενο με δυνατότητα αναζήτησης.</p>
```csharp
using IronOcr;
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Greek; // Set the OCR language to Greek
using (var Input = new OcrInput())
{
// Add a multi-frame TIFF for OCR
Input.AddMultiFrameTiff("multi-frame.tiff");
var Result = Ocr.Read(Input); // Perform OCR
Console.WriteLine(Result.Text); // Output the extracted text
}
```
<h3>Γραμμικοί κώδικες και QR</h3>
<p>Ένα μοναδικό χαρακτηριστικό του IronOCR είναι ότι μπορεί να διαβάσει γραμμωτούς κώδικες και κωδικούς QR από έγγραφα ενώ κάνει σάρωση για κείμενο. Οι <code>OcrResult.OcrBarcode</code> κλάσης παρέχουν στον προγραμματιστή λεπτομερείς πληροφορίες για κάθε σαρωμένο γραμμωτό κώδικα.</p>
```csharp
using IronOcr;
var Ocr = new IronTesseract();
Ocr.Configuration.ReadBarCodes = true; // Enable barcode reading
using (var input = new OcrInput())
{
input.AddImage("img/Barcode.png"); // Add an image containing a barcode
var Result = Ocr.Read(input); // Read the image for barcodes
foreach (var Barcode in Result.Barcodes)
{
Console.WriteLine(Barcode.Value);
// Output barcode values; properties for type and location are also exposed
}
}
```
<h3>OCR σε συγκεκριμένες περιοχές εικόνων</h3>
<p>Όλες οι μέθοδοι σάρωσης και ανάγνωσης του IronOCR παρέχουν τη δυνατότητα καθορισμού ακριβώς από ποιο μέρος μιας σελίδας ή σελίδων από τις οποίες επιθυμούμε να διαβάσουμε κείμενο. Αυτό είναι πολύ χρήσιμο όταν εξετάζουμε τυποποιημένες φόρμες και μπορεί να εξοικονομήσει πολύ χρόνο και να βελτιώσει την αποτελεσματικότητα.</p>
<p>Για να χρησιμοποιήσουμε περιοχές περικοπής, θα πρέπει να προσθέσουμε μια αναφορά συστήματος στο <code>System.Drawing</code> ώστε να μπορούμε να χρησιμοποιήσουμε το αντικείμενο <code>System.Drawing.Rectangle</code>.</p>
```csharp
using IronOcr;
using System.Drawing;
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Greek; // Set the language to Greek
using (var Input = new OcrInput())
{
// Define the area of interest
var ContentArea = new System.Drawing.Rectangle { X = 215, Y = 1250, Height = 280, Width = 1335 };
// Οι διαστάσεις είναι σε px
Input.Add("document.png", ContentArea); // Add image and set crop area
var Result = Ocr.Read(Input); // Perform OCR
Console.WriteLine(Result.Text); // Output the result
}
```
<h3>OCR για σαρώσεις χαμηλής ποιότητας</h3>
<p>Η κατηγορία IronOCR <code>OcrInput</code> μπορεί να διορθώσει τις σαρώσεις που δεν μπορεί να διαβάσει το κανονικό Tesseract.</p>
```csharp
using IronOcr;
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Greek; // Set the language to Greek
using (var Input = new OcrInput(@"img\Potter.LowQuality.tiff"))
{
Input.DeNoise(); // Correct digital noise
Input.Deskew(); // Correct skew
var Result = Ocr.Read(Input); // Perform OCR
Console.WriteLine(Result.Text); // Output the text
}
```
<h3>Εξαγωγή αποτελεσμάτων OCR ως PDF με δυνατότητα αναζήτησης</h3>
<p>Εικόνα σε PDF με συμβολοσειρές κειμένου με δυνατότητα αντιγραφής. Μπορεί να ευρετηριαστεί από μηχανές αναζήτησης και βάσεις δεδομένων.</p>
```csharp
using IronOcr;
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Greek; // Set the language to Greek
using (var Input = new OcrInput())
{
input.Title = "Quarterly Report"; // Set the title for the document
Input.AddImage("image1.jpeg"); // Add images to the input
Input.AddImage("image2.png");
Input.AddImage("image3.gif");
var Result = Ocr.Read(input); // Perform OCR
Result.SaveAsSearchablePdf("searchable.pdf"); // Save as searchable PDF
}
```
<h3>TIFF σε μετατροπή PDF με δυνατότητα αναζήτησης</h3>
<p>Μετατρέψτε ένα έγγραφο TIFF (ή οποιαδήποτε ομάδα αρχείων εικόνας) απευθείας σε PDF με δυνατότητα αναζήτησης, το οποίο μπορεί να ευρετηριαστεί από τις μηχανές αναζήτησης intranet, ιστότοπου και google.</p>
```csharp
using IronOcr;
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Greek; // Set the language to Greek
using (var Input = new OcrInput())
{
input.AddMultiFrameTiff("example.tiff"); // Add TIFF for conversion
var Result = Ocr.Read(input).SaveAsSearchablePdf("searchable.pdf"); // Convert and save as searchable PDF
}
```
<h3>Εξαγωγή αποτελεσμάτων OCR ως HTML</h3>
<p>OCR Εικόνα σε μετατροπή XHTML.</p>
```csharp
using IronOcr;
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Greek; // Set the language to Greek
using (var Input = new OcrInput())
{
input.Title = "Html Title"; // Set the title for the XHTML document
Input.AddImage("image1.jpeg"); // Add the image to process
var Result = Ocr.Read(input); // Perform OCR
Result.SaveAsHocrFile("results.html"); // Save the result as HTML
}
```
<h2>Φίλτρα βελτίωσης εικόνας OCR</h2>
<p>Το IronOCR παρέχει μοναδικά φίλτρα για αντικείμενα <code>OcrInput</code> για τη βελτίωση της απόδοσης του OCR.</p>
<h3>Παράδειγμα κώδικα βελτίωσης εικόνας</h3>
<p>Κάνει τις εικόνες εισόδου OCR υψηλότερης ποιότητας για να παράγει καλύτερα, ταχύτερα αποτελέσματα OCR.</p>
```csharp
using IronOcr;
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Greek; // Set the language to Greek
using (var Input = new OcrInput(@"LowQuality.jpeg"))
{
Input.DeNoise(); // Corrects digital noise
Input.Deskew(); // Corrects skew and perspective
var Result = Ocr.Read(Input); // Perform OCR
Console.WriteLine(Result.Text); // Output the text
}
```
<h3>Λίστα φίλτρων εικόνων OCR</h3>
<p>Τα φίλτρα εισόδου για την ενίσχυση της απόδοσης OCR που είναι ενσωματωμένα στο IronOCR περιλαμβάνουν:</p>
<ul>
<li><strong>OcrInput.Rotate (διπλές μοίρες)</strong> - Περιστρέφει τις εικόνες κατά αριθμό μοίρες δεξιόστροφα. Για
αριστερόστροφα, χρησιμοποιήστε αρνητικούς αριθμούς.</li>
<li><strong>OcrInput.Binarize ()</strong> - Μετατρέπει κάθε εικονοστοιχείο ασπρόμαυρο. Μπορεί να βελτιώσει τις περιπτώσεις απόδοσης OCR με πολύ χαμηλή αντίθεση.</li>
<li><strong>OcrInput.ToGrayScale ()</strong> - Μετατρέπει κάθε εικονοστοιχείο σε γκρι κλίμακα. Μπορεί να βελτιώσει την ταχύτητα OCR.</li>
<li><strong>OcrInput.Contrast ()</strong> - Αυξάνει αυτόματα την αντίθεση και βελτιώνει την ακρίβεια σε σαρώσεις χαμηλής αντίθεσης.</li>
<li><strong>OcrInput.DeNoise ()</strong> - Αφαιρεί τον ψηφιακό θόρυβο.</li>
<li><strong>OcrInput.Invert ()</strong> - Αντιστρέφει κάθε χρώμα. Π.χ. Λευκό γίνεται μαύρο: το μαύρο γίνεται λευκό.</li>
<li><strong>OcrInput.Dilate ()</strong> - Προηγμένη Μορφολογία που προσθέτει pixel στα όρια των αντικειμένων σε μια εικόνα.</li>
<li><strong>OcrInput.Erode ()</strong> - Προηγμένη Μορφολογία που αφαιρεί τα εικονοστοιχεία στα όρια αντικειμένου.</li>
<li><strong>OcrInput.Deskew ()</strong> - Περιστρέφει την εικόνα ώστε να είναι ορθογώνια και με σωστό προσανατολισμό.</li>
<li><strong>OcrInput.DeepCleanBackgroundNoise ()</strong> - Αφαίρεση θορύβου έντονου παρασκηνίου.</li>
<li><strong>OcrInput.EnhanceResolution</strong> - Βελτιώνει την ανάλυση εικόνων χαμηλής ποιότητας.</li>
</ul>
<p><strong>Ορισμένα χαρακτηριστικά φιλτραρίσματος:</strong></p>
<ul>
<li><strong>CleanBackgroundNoise</strong>: Καθαρίζει θορύβους φόντου, τσακίσεις και ατέλειες για καλύτερα αποτελέσματα OCR.</li>
<li><strong>EnhanceContrast</strong>: Αυξάνει την αντίθεση για βελτιωμένη ακρίβεια και ταχύτητα OCR.</li>
<li><strong>EnhanceResolution</strong>: Ανιχνεύει και βελτιώνει αυτόματα εικόνες χαμηλής ανάλυσης.</li>
<li><strong>Language</strong>: Υποστηρίζει 22 διεθνή γλωσσικά πακέτα για OCR.</li>
<li><strong>Στρατηγική</strong>: Επιλέξτε μεταξύ ταχύτητας και ακρίβειας με προσαρμοσμένη προσέγγιση παραμετροποίησης.</li>
<li><strong>ColorSpace</strong>: Μάθετε το OCR σε γκρι ή έγχρωμο χώρο χρώματος αναλόγως τις απαιτήσεις.</li>
<li><strong>DetectWhiteTextOnDarkBackgrounds</strong>: Εντοπίζει και διαβάζει αρνητικά από σκοτεινές σελίδες με λευκό κείμενο.</li>
<li><strong>Τύπος εισόδου εικόνας</strong>: Καθορίστε τον τύπο εισόδου όπως πλήρες έγγραφο ή απόσπασμα.</li>
<li><strong>RotateAndStraighten</strong>: Διαβάζει ντοκουμέντα με περιστροφικά στοιχεία και προοπτική.</li>
<li><strong>ReadBarcodes</strong>: Διαβάζει γραμμωτούς κώδικες και κωδικούς QR παράλληλα με το κείμενο.</li>
<li><strong>Βάθος χρώματος</strong>: Καθορίστε bit ανά pixel για την ποιότητα του OCR.</li>
</ul>
<h2>126 πακέτα γλωσσών</h2>
<p>Το IronOCR υποστηρίζει <strong>126 διεθνείς γλώσσες</strong> μέσω πακέτων γλωσσών που διανέμονται ως DLL, τα οποία μπορείτε να <a href="/csharp/ocr/languages/">κατεβάσετε από αυτόν τον ιστότοπο</a> ή επίσης από το <a href="https://www.nuget.org/packages?q=IronOcr.Languages">NuGet Package Manager</a>.</p>
<p>Οι γλώσσες περιλαμβάνουν Γερμανικά, Γαλλικά, Αγγλικά, Κινέζικα, Ιαπωνικά και πολλά άλλα. Υπάρχουν πακέτα ειδικών γλωσσών για διαβατήρια MRZ, ελέγχους MICR, Οικονομικά δεδομένα, πινακίδες κυκλοφορίας και πολλά άλλα. Μπορείτε επίσης να χρησιμοποιήσετε οποιοδήποτε αρχείο Tesseract ".traineddata" - συμπεριλαμβανομένων αυτών που δημιουργείτε μόνοι σας.</p>
<h3>Παράδειγμα γλώσσας</h3>
<p>Χρήση άλλων γλωσσών OCR.</p>
```csharp
// PM> Install-Package IronOcr.Languages.Arabic
using IronOcr;
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Arabic; // Set OCR language to Arabic
using (var input = new OcrInput())
{
input.AddImage("img/arabic.gif"); // Add image to process
var Result = Ocr.Read(input); // Perform OCR
// Save the result as a text file since console can't easily print Arabic text
Result.SaveAsTextFile("arabic.txt");
}
```
<h3>Παράδειγμα πολλαπλής γλώσσας</h3>
<p>Είναι επίσης δυνατό το OCR να χρησιμοποιεί πολλές γλώσσες ταυτόχρονα. Αυτό μπορεί πραγματικά να βοηθήσει στη λήψη μεταδεδομένων και διευθύνσεων URL στην αγγλική γλώσσα σε έγγραφα Unicode.</p>
```csharp
// PM> Install-Package IronOcr.Languages.ChineseSimplified
using IronOcr;
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.ChineseSimplified; // Set primary language to Chinese Simplified
Ocr.AddSecondaryLanguage(OcrLanguage.Greek); // Add Greek as a secondary language
// Add as many languages as needed
using (var input = new OcrInput())
{
input.Add("multi-language.pdf"); // Add multi-language PDF
var Result = Ocr.Read(input); // Perform OCR
Result.SaveAsTextFile("results.txt"); // Save result to text file
}
```
<h2>Λεπτομερή αντικείμενα αποτελεσμάτων OCR</h2>
<p>Το IronOCR επιστρέφει ένα αντικείμενο αποτελέσματος OCR για κάθε λειτουργία OCR. Γενικά, οι προγραμματιστές χρησιμοποιούν μόνο την ιδιότητα κειμένου αυτού του αντικειμένου για να κάνουν τη σάρωση του κειμένου από την εικόνα. Ωστόσο, τα αποτελέσματα OCR DOM είναι πολύ πιο προηγμένα από αυτό.</p>
```csharp
using IronOcr;
using System.Drawing; //Προσθήκη αναφοράς συναρμολόγησης
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Greek; // Set the language to Greek
Ocr.Configuration.EngineMode = TesseractEngineMode.TesseractAndLstm; // Configure engine mode
Ocr.Configuration.ReadBarCodes = true; // Enable barcode reading
using (var Input = new OcrInput(@"images\sample.tiff"))
{
OcrResult Result = Ocr.Read(Input); // Perform OCR
// Access detailed result information
var Pages = Result.Pages;
var Words = Pages[0].Words;
var Barcodes = Result.Barcodes;
// Εξερευνήστε εδώ για να βρείτε ένα τεράστιο, λεπτομερές API:
// - Σελίδες, μπλοκ, παραφράσεις, γραμμές, λέξεις, χαρακτήρες
// - Εξαγωγή εικόνας, Συντεταγμένες γραμματοσειρών, Στατιστικά δεδομένα
}
```
<h2>Εκτέλεση</h2>
<p>Το IronOCR λειτουργεί έξω από το κουτί χωρίς να χρειάζεται να συντονιστείτε η απόδοση ή να τροποποιήσετε σε μεγάλο βαθμό τις εικόνες εισόδου.</p>
<p>Η ταχύτητα είναι απίστευτη: Το IronOCR.2020 + είναι έως και 10 φορές πιο γρήγορο και κάνει πάνω από 250% λιγότερα σφάλματα από τις προηγούμενες εκδόσεις.</p>
<h2>Μάθε περισσότερα</h2>
<p>Για να μάθετε περισσότερα σχετικά με το OCR σε C#, VB, F# ή σε οποιαδήποτε άλλη γλώσσα .NET, <a href="/csharp/ocr/tutorials/how-to-read-text-from-an-image-in-csharp-net/">διαβάστε τα εκπαιδευτικά σεμινάρια της κοινότητάς μας</a>, τα οποία δίνουν πραγματικά παραδείγματα για το πώς μπορεί να χρησιμοποιηθεί το IronOCR και μπορεί να δείξει τις αποχρώσεις του πώς να αξιοποιήσετε στο έπακρο αυτή την βιβλιοθήκη.</p>
<p>Διατίθεται επίσης πλήρης <a href="/csharp/ocr/object-reference/api/">αναφορά αντικειμένου για προγραμματιστές .NET</a>.</p>
Το IronOCR είναι ένα στοιχείο λογισμικού C# που επιτρέπει στους .NET κωδικοποιητές να διαβάζουν κείμενο από εικόνες και έγγραφα PDF σε 126 γλώσσες, συμπεριλαμβανομένου του Ελληνικού Αλφαβήτου.
Πρόκειται για ένα προηγμένο πιρούνι του Tesseract, κατασκευασμένο αποκλειστικά για τους προγραμματιστές .NET και ξεπερνά τακτικά άλλους κινητήρες Tesseract για ταχύτητα και ακρίβεια.
Το πρώτο πράγμα που πρέπει να κάνουμε είναι να εγκαταστήσουμε το πακέτο μας Greek Alphabet OCR στο έργο σας .NET.
PM> Install-Package IronOcr.Languages.Greek
Παράδειγμα κώδικα
Αυτό το παράδειγμα κώδικα C# διαβάζει κείμενο ελληνικού αλφαβήτου από έγγραφο εικόνας ή PDF.
// Install the Greek language package using NuGet// PM> Install-Package IronOcr.Languages.Greekusing IronOcr;varOcr = new IronTesseract();Ocr.Language = OcrLanguage.Greek; // Set the OCR language to Greekusing (varInput = new OcrInput(@"images\Greek.png")){ varResult = Ocr.Read(Input); // Perform OCR on the input image varAllText = Result.Text; // Get the extracted textConsole.WriteLine(AllText); // Print the extracted text}
// Install the Greek language package using NuGet
// PM> Install-Package IronOcr.Languages.Greek
using IronOcr;
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Greek; // Set the OCR language to Greek
using (var Input = new OcrInput(@"images\Greek.png"))
{
var Result = Ocr.Read(Input); // Perform OCR on the input image
var AllText = Result.Text; // Get the extracted text
Console.WriteLine(AllText); // Print the extracted text
}
ImportsIronOcr' Install the Greek language package using NuGet' PM> Install-Package IronOcr.Languages.GreekDimOcrAs New IronTesseract()Ocr.Language = OcrLanguage.Greek' Set the OCR language to GreekUsingInputAs New OcrInput("images\Greek.png") DimResult = Ocr.Read(Input) ' Perform OCR on the input image DimAllText = Result.Text' Get the extracted textConsole.WriteLine(AllText) ' Print the extracted textEndUsing
Imports IronOcr
' Install the Greek language package using NuGet
' PM> Install-Package IronOcr.Languages.Greek
Dim Ocr As New IronTesseract()
Ocr.Language = OcrLanguage.Greek ' Set the OCR language to Greek
Using Input As New OcrInput("images\Greek.png")
Dim Result = Ocr.Read(Input) ' Perform OCR on the input image
Dim AllText = Result.Text ' Get the extracted text
Console.WriteLine(AllText) ' Print the extracted text
End Using
Γιατί να επιλέξετε IronOCR;
Το IronOCR είναι μια εύκολη εγκατάσταση, πλήρης και καλά τεκμηριωμένη βιβλιοθήκη λογισμικού .NET.
Επιλέξτε IronOCR για να επιτύχετε 99,8% + ακρίβεια OCR χωρίς να χρησιμοποιήσετε εξωτερικές υπηρεσίες ιστού, τρέχουσες χρεώσεις ή αποστολή εμπιστευτικών εγγράφων μέσω του Διαδικτύου.
Γιατί οι προγραμματιστές C# επιλέγουν το IronOCR έναντι του Vanilla Tesseract:
Εγκατάσταση ως μεμονωμένο DLL ή NuGet
Περιλαμβάνει κινητήρες Tesseract 5, 4 και 3 εκτός κουτιού.
Η ακρίβεια 99,8% ξεπερνά σημαντικά το κανονικό Tesseract.
Blazing Speed και MultiThreading
MVC, WebApp, Desktop, Console & Server Application συμβατό
Δεν υπάρχει κωδικός Exes ή C ++ για εργασία
Πλήρης υποστήριξη PDF OCR
Για να εκτελέσετε OCR σχεδόν οποιοδήποτε αρχείο εικόνας ή PDF
Πλήρης υποστήριξη .NET Core, Standard και FrameWork
Ανάπτυξη σε Windows, Mac, Linux, Azure, Docker, Lambda, AWS
Διαβάστε γραμμωτούς κώδικες και κωδικούς QR
Εξαγωγή OCR ως XHTML
Εξαγωγή OCR σε έγγραφα PDF με δυνατότητα αναζήτησης
Υποστήριξη πολλαπλών νημάτων
126 διεθνείς γλώσσες διαχειρίζονται όλες μέσω αρχείων NuGet ή OcrData
Εξαγωγή εικόνων, συντεταγμένων, στατιστικών και γραμματοσειρών. Όχι μόνο κείμενο.
Μπορεί να χρησιμοποιηθεί για την αναδιανομή του Tesseract OCR σε εμπορικές και ιδιόκτητες εφαρμογές.
Το IronOCR λάμπει όταν εργάζεστε με εικόνες πραγματικού κόσμου και ατελή έγγραφα όπως φωτογραφίες ή σαρώσεις χαμηλής ανάλυσης που ενδέχεται να έχουν ψηφιακό θόρυβο ή ατέλειες.
Άλλες δωρεάν βιβλιοθήκες OCR για την πλατφόρμα .NET όπως άλλες .NET Tesseract APIs και υπηρεσίες ιστού δεν αποδίδουν τόσο καλά σε αυτές τις περιπτώσεις χρήσης του πραγματικού κόσμου.
OCR με Tesseract 5 - Ξεκινήστε την κωδικοποίηση σε C#
Το παρακάτω δείγμα κώδικα δείχνει πόσο εύκολο είναι να διαβάσετε κείμενο από μια εικόνα χρησιμοποιώντας C# ή VB .NET.
OneLiner
varText = new IronTesseract().Read(@"img\Screenshot.png").Text;// One line of code to perform OCR and retrieve text from a PNG image.
var Text = new IronTesseract().Read(@"img\Screenshot.png").Text;
// One line of code to perform OCR and retrieve text from a PNG image.
DimText = (New IronTesseract()).Read("img\Screenshot.png").Text' One line of code to perform OCR and retrieve text from a PNG image.
Dim Text = (New IronTesseract()).Read("img\Screenshot.png").Text
' One line of code to perform OCR and retrieve text from a PNG image.
Διαμορφώσιμο Hello World
// PM> Install-Package IronOcr.Languages.Greekusing IronOcr;// Initialize the OCR enginevarOcr = new IronTesseract();Ocr.Language = OcrLanguage.Greek; // Set the language to Greekusing (varInput = new OcrInput()){Input.AddImage("images/sample.jpeg"); // Add an image to the OCR input // ... μπορείτε να προσθέσετε οποιονδήποτε αριθμό εικόνων varResult = Ocr.Read(Input); // Perform OCR on the inputConsole.WriteLine(Result.Text); // Output the text}
// PM> Install-Package IronOcr.Languages.Greek
using IronOcr;
// Initialize the OCR engine
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Greek; // Set the language to Greek
using (var Input = new OcrInput())
{
Input.AddImage("images/sample.jpeg"); // Add an image to the OCR input
// ... μπορείτε να προσθέσετε οποιονδήποτε αριθμό εικόνων
var Result = Ocr.Read(Input); // Perform OCR on the input
Console.WriteLine(Result.Text); // Output the text
}
ImportsIronOcr' Initialize the OCR engineDimOcrAs New IronTesseract()Ocr.Language = OcrLanguage.Greek' Set the language to GreekUsingInputAs New OcrInput()Input.AddImage("images/sample.jpeg") ' Add an image to the OCR input ' ... μπορείτε να προσθέσετε οποιονδήποτε αριθμό εικόνων DimResult = Ocr.Read(Input) ' Perform OCR on the inputConsole.WriteLine(Result.Text) ' Output the textEndUsing
Imports IronOcr
' Initialize the OCR engine
Dim Ocr As New IronTesseract()
Ocr.Language = OcrLanguage.Greek ' Set the language to Greek
Using Input As New OcrInput()
Input.AddImage("images/sample.jpeg") ' Add an image to the OCR input
' ... μπορείτε να προσθέσετε οποιονδήποτε αριθμό εικόνων
Dim Result = Ocr.Read(Input) ' Perform OCR on the input
Console.WriteLine(Result.Text) ' Output the text
End Using
C# PDF OCR
Η ίδια προσέγγιση μπορεί ομοίως να χρησιμοποιηθεί για την εξαγωγή κειμένου από οποιοδήποτε έγγραφο PDF.
using IronOcr;varOcr = new IronTesseract();Ocr.Language = OcrLanguage.Greek; // Set the language to Greekusing (var input = new OcrInput()){ // Add a PDF for OCR; optionally set a password if needed input.AddPdf("example.pdf", "password"); // Μπορούμε επίσης να επιλέξουμε συγκεκριμένους αριθμούς σελίδων PDF στο OCR varResult = Ocr.Read(input); // Read the OCR results // Output the text and the number of pages processedConsole.WriteLine(Result.Text);Console.WriteLine($"{Result.Pages.Count} Pages"); // 1 σελίδα για κάθε σελίδα του PDF}
using IronOcr;
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Greek; // Set the language to Greek
using (var input = new OcrInput())
{
// Add a PDF for OCR; optionally set a password if needed
input.AddPdf("example.pdf", "password");
// Μπορούμε επίσης να επιλέξουμε συγκεκριμένους αριθμούς σελίδων PDF στο OCR
var Result = Ocr.Read(input); // Read the OCR results
// Output the text and the number of pages processed
Console.WriteLine(Result.Text);
Console.WriteLine($"{Result.Pages.Count} Pages");
// 1 σελίδα για κάθε σελίδα του PDF
}
ImportsIronOcrPrivateOcr = New IronTesseract()Ocr.Language = OcrLanguage.Greek' Set the language to GreekUsing input = New OcrInput() ' Add a PDF for OCR; optionally set a password if needed input.AddPdf("example.pdf", "password") ' Μπορούμε επίσης να επιλέξουμε συγκεκριμένους αριθμούς σελίδων PDF στο OCR DimResult = Ocr.Read(input) ' Read the OCR results ' Output the text and the number of pages processedConsole.WriteLine(Result.Text)Console.WriteLine($"{Result.Pages.Count} Pages") ' 1 σελίδα για κάθε σελίδα του PDFEndUsing
Imports IronOcr
Private Ocr = New IronTesseract()
Ocr.Language = OcrLanguage.Greek ' Set the language to Greek
Using input = New OcrInput()
' Add a PDF for OCR; optionally set a password if needed
input.AddPdf("example.pdf", "password")
' Μπορούμε επίσης να επιλέξουμε συγκεκριμένους αριθμούς σελίδων PDF στο OCR
Dim Result = Ocr.Read(input) ' Read the OCR results
' Output the text and the number of pages processed
Console.WriteLine(Result.Text)
Console.WriteLine($"{Result.Pages.Count} Pages")
' 1 σελίδα για κάθε σελίδα του PDF
End Using
OCR για TIFF πολλαπλών σελίδων
Μορφή αρχείου TIFF ανάγνωσης OCR που περιλαμβάνει έγγραφα πολλών σελίδων. Το TIFF μπορεί επίσης να μετατραπεί απευθείας σε αρχείο PDF με κείμενο με δυνατότητα αναζήτησης.
using IronOcr;varOcr = new IronTesseract();Ocr.Language = OcrLanguage.Greek; // Set the OCR language to Greekusing (varInput = new OcrInput()){ // Add a multi-frame TIFF for OCRInput.AddMultiFrameTiff("multi-frame.tiff"); varResult = Ocr.Read(Input); // Perform OCRConsole.WriteLine(Result.Text); // Output the extracted text}
using IronOcr;
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Greek; // Set the OCR language to Greek
using (var Input = new OcrInput())
{
// Add a multi-frame TIFF for OCR
Input.AddMultiFrameTiff("multi-frame.tiff");
var Result = Ocr.Read(Input); // Perform OCR
Console.WriteLine(Result.Text); // Output the extracted text
}
ImportsIronOcrPrivateOcr = New IronTesseract()Ocr.Language = OcrLanguage.Greek' Set the OCR language to GreekUsingInput = New OcrInput() ' Add a multi-frame TIFF for OCRInput.AddMultiFrameTiff("multi-frame.tiff") DimResult = Ocr.Read(Input) ' Perform OCRConsole.WriteLine(Result.Text) ' Output the extracted textEndUsing
Imports IronOcr
Private Ocr = New IronTesseract()
Ocr.Language = OcrLanguage.Greek ' Set the OCR language to Greek
Using Input = New OcrInput()
' Add a multi-frame TIFF for OCR
Input.AddMultiFrameTiff("multi-frame.tiff")
Dim Result = Ocr.Read(Input) ' Perform OCR
Console.WriteLine(Result.Text) ' Output the extracted text
End Using
Γραμμικοί κώδικες και QR
Ένα μοναδικό χαρακτηριστικό του IronOCR είναι ότι μπορεί να διαβάσει γραμμωτούς κώδικες και κωδικούς QR από έγγραφα ενώ κάνει σάρωση για κείμενο. Οι OcrResult.OcrBarcode κλάσης παρέχουν στον προγραμματιστή λεπτομερείς πληροφορίες για κάθε σαρωμένο γραμμωτό κώδικα.
using IronOcr;varOcr = new IronTesseract();Ocr.Configuration.ReadBarCodes = true; // Enable barcode readingusing (var input = new OcrInput()){ input.AddImage("img/Barcode.png"); // Add an image containing a barcode varResult = Ocr.Read(input); // Read the image for barcodes foreach (varBarcodeinResult.Barcodes) {Console.WriteLine(Barcode.Value); // Output barcode values; properties for type and location are also exposed }}
using IronOcr;
var Ocr = new IronTesseract();
Ocr.Configuration.ReadBarCodes = true; // Enable barcode reading
using (var input = new OcrInput())
{
input.AddImage("img/Barcode.png"); // Add an image containing a barcode
var Result = Ocr.Read(input); // Read the image for barcodes
foreach (var Barcode in Result.Barcodes)
{
Console.WriteLine(Barcode.Value);
// Output barcode values; properties for type and location are also exposed
}
}
ImportsIronOcrPrivateOcr = New IronTesseract()Ocr.Configuration.ReadBarCodes = True ' Enable barcode readingUsing input = New OcrInput() input.AddImage("img/Barcode.png") ' Add an image containing a barcode DimResult = Ocr.Read(input) ' Read the image for barcodes For EachBarcodeInResult.BarcodesConsole.WriteLine(Barcode.Value) ' Output barcode values; properties for type and location are also exposed NextBarcodeEndUsing
Imports IronOcr
Private Ocr = New IronTesseract()
Ocr.Configuration.ReadBarCodes = True ' Enable barcode reading
Using input = New OcrInput()
input.AddImage("img/Barcode.png") ' Add an image containing a barcode
Dim Result = Ocr.Read(input) ' Read the image for barcodes
For Each Barcode In Result.Barcodes
Console.WriteLine(Barcode.Value)
' Output barcode values; properties for type and location are also exposed
Next Barcode
End Using
OCR σε συγκεκριμένες περιοχές εικόνων
Όλες οι μέθοδοι σάρωσης και ανάγνωσης του IronOCR παρέχουν τη δυνατότητα καθορισμού ακριβώς από ποιο μέρος μιας σελίδας ή σελίδων από τις οποίες επιθυμούμε να διαβάσουμε κείμενο. Αυτό είναι πολύ χρήσιμο όταν εξετάζουμε τυποποιημένες φόρμες και μπορεί να εξοικονομήσει πολύ χρόνο και να βελτιώσει την αποτελεσματικότητα.
Για να χρησιμοποιήσουμε περιοχές περικοπής, θα πρέπει να προσθέσουμε μια αναφορά συστήματος στο System.Drawing ώστε να μπορούμε να χρησιμοποιήσουμε το αντικείμενο System.Drawing.Rectangle.
using IronOcr;using System.Drawing;varOcr = new IronTesseract();Ocr.Language = OcrLanguage.Greek; // Set the language to Greekusing (varInput = new OcrInput()){ // Define the area of interest varContentArea = new System.Drawing.Rectangle { X = 215, Y = 1250, Height = 280, Width = 1335 }; // Οι διαστάσεις είναι σε pxInput.Add("document.png", ContentArea); // Add image and set crop area varResult = Ocr.Read(Input); // Perform OCRConsole.WriteLine(Result.Text); // Output the result}
using IronOcr;
using System.Drawing;
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Greek; // Set the language to Greek
using (var Input = new OcrInput())
{
// Define the area of interest
var ContentArea = new System.Drawing.Rectangle { X = 215, Y = 1250, Height = 280, Width = 1335 };
// Οι διαστάσεις είναι σε px
Input.Add("document.png", ContentArea); // Add image and set crop area
var Result = Ocr.Read(Input); // Perform OCR
Console.WriteLine(Result.Text); // Output the result
}
ImportsIronOcrImportsSystem.DrawingPrivateOcr = New IronTesseract()Ocr.Language = OcrLanguage.Greek' Set the language to GreekUsingInput = New OcrInput() ' Define the area of interest DimContentArea = New System.Drawing.RectangleWith { .X = 215, .Y = 1250, .Height = 280, .Width = 1335 } ' Οι διαστάσεις είναι σε pxInput.Add("document.png", ContentArea) ' Add image and set crop area DimResult = Ocr.Read(Input) ' Perform OCRConsole.WriteLine(Result.Text) ' Output the resultEndUsing
Imports IronOcr
Imports System.Drawing
Private Ocr = New IronTesseract()
Ocr.Language = OcrLanguage.Greek ' Set the language to Greek
Using Input = New OcrInput()
' Define the area of interest
Dim ContentArea = New System.Drawing.Rectangle With {
.X = 215,
.Y = 1250,
.Height = 280,
.Width = 1335
}
' Οι διαστάσεις είναι σε px
Input.Add("document.png", ContentArea) ' Add image and set crop area
Dim Result = Ocr.Read(Input) ' Perform OCR
Console.WriteLine(Result.Text) ' Output the result
End Using
OCR για σαρώσεις χαμηλής ποιότητας
Η κατηγορία IronOCR OcrInput μπορεί να διορθώσει τις σαρώσεις που δεν μπορεί να διαβάσει το κανονικό Tesseract.
using IronOcr;varOcr = new IronTesseract();Ocr.Language = OcrLanguage.Greek; // Set the language to Greekusing (varInput = new OcrInput(@"img\Potter.LowQuality.tiff")){Input.DeNoise(); // Correct digital noiseInput.Deskew(); // Correct skew varResult = Ocr.Read(Input); // Perform OCRConsole.WriteLine(Result.Text); // Output the text}
using IronOcr;
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Greek; // Set the language to Greek
using (var Input = new OcrInput(@"img\Potter.LowQuality.tiff"))
{
Input.DeNoise(); // Correct digital noise
Input.Deskew(); // Correct skew
var Result = Ocr.Read(Input); // Perform OCR
Console.WriteLine(Result.Text); // Output the text
}
ImportsIronOcrPrivateOcr = New IronTesseract()Ocr.Language = OcrLanguage.Greek' Set the language to GreekUsingInput = New OcrInput("img\Potter.LowQuality.tiff")Input.DeNoise() ' Correct digital noiseInput.Deskew() ' Correct skew DimResult = Ocr.Read(Input) ' Perform OCRConsole.WriteLine(Result.Text) ' Output the textEndUsing
Imports IronOcr
Private Ocr = New IronTesseract()
Ocr.Language = OcrLanguage.Greek ' Set the language to Greek
Using Input = New OcrInput("img\Potter.LowQuality.tiff")
Input.DeNoise() ' Correct digital noise
Input.Deskew() ' Correct skew
Dim Result = Ocr.Read(Input) ' Perform OCR
Console.WriteLine(Result.Text) ' Output the text
End Using
Εξαγωγή αποτελεσμάτων OCR ως PDF με δυνατότητα αναζήτησης
Εικόνα σε PDF με συμβολοσειρές κειμένου με δυνατότητα αντιγραφής. Μπορεί να ευρετηριαστεί από μηχανές αναζήτησης και βάσεις δεδομένων.
using IronOcr;varOcr = new IronTesseract();Ocr.Language = OcrLanguage.Greek; // Set the language to Greekusing (varInput = new OcrInput()){ input.Title = "Quarterly Report"; // Set the title for the documentInput.AddImage("image1.jpeg"); // Add images to the inputInput.AddImage("image2.png");Input.AddImage("image3.gif"); varResult = Ocr.Read(input); // Perform OCRResult.SaveAsSearchablePdf("searchable.pdf"); // Save as searchable PDF}
using IronOcr;
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Greek; // Set the language to Greek
using (var Input = new OcrInput())
{
input.Title = "Quarterly Report"; // Set the title for the document
Input.AddImage("image1.jpeg"); // Add images to the input
Input.AddImage("image2.png");
Input.AddImage("image3.gif");
var Result = Ocr.Read(input); // Perform OCR
Result.SaveAsSearchablePdf("searchable.pdf"); // Save as searchable PDF
}
ImportsIronOcrPrivateOcr = New IronTesseract()Ocr.Language = OcrLanguage.Greek' Set the language to GreekUsingInput = New OcrInput() input.Title = "Quarterly Report" ' Set the title for the documentInput.AddImage("image1.jpeg") ' Add images to the inputInput.AddImage("image2.png")Input.AddImage("image3.gif") DimResult = Ocr.Read(input) ' Perform OCRResult.SaveAsSearchablePdf("searchable.pdf") ' Save as searchable PDFEndUsing
Imports IronOcr
Private Ocr = New IronTesseract()
Ocr.Language = OcrLanguage.Greek ' Set the language to Greek
Using Input = New OcrInput()
input.Title = "Quarterly Report" ' Set the title for the document
Input.AddImage("image1.jpeg") ' Add images to the input
Input.AddImage("image2.png")
Input.AddImage("image3.gif")
Dim Result = Ocr.Read(input) ' Perform OCR
Result.SaveAsSearchablePdf("searchable.pdf") ' Save as searchable PDF
End Using
TIFF σε μετατροπή PDF με δυνατότητα αναζήτησης
Μετατρέψτε ένα έγγραφο TIFF (ή οποιαδήποτε ομάδα αρχείων εικόνας) απευθείας σε PDF με δυνατότητα αναζήτησης, το οποίο μπορεί να ευρετηριαστεί από τις μηχανές αναζήτησης intranet, ιστότοπου και google.
using IronOcr;varOcr = new IronTesseract();Ocr.Language = OcrLanguage.Greek; // Set the language to Greekusing (varInput = new OcrInput()){ input.AddMultiFrameTiff("example.tiff"); // Add TIFF for conversion varResult = Ocr.Read(input).SaveAsSearchablePdf("searchable.pdf"); // Convert and save as searchable PDF}
using IronOcr;
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Greek; // Set the language to Greek
using (var Input = new OcrInput())
{
input.AddMultiFrameTiff("example.tiff"); // Add TIFF for conversion
var Result = Ocr.Read(input).SaveAsSearchablePdf("searchable.pdf"); // Convert and save as searchable PDF
}
ImportsIronOcrPrivateOcr = New IronTesseract()Ocr.Language = OcrLanguage.Greek' Set the language to GreekUsingInput = New OcrInput() input.AddMultiFrameTiff("example.tiff") ' Add TIFF for conversion DimResult = Ocr.Read(input).SaveAsSearchablePdf("searchable.pdf") ' Convert and save as searchable PDFEndUsing
Imports IronOcr
Private Ocr = New IronTesseract()
Ocr.Language = OcrLanguage.Greek ' Set the language to Greek
Using Input = New OcrInput()
input.AddMultiFrameTiff("example.tiff") ' Add TIFF for conversion
Dim Result = Ocr.Read(input).SaveAsSearchablePdf("searchable.pdf") ' Convert and save as searchable PDF
End Using
Εξαγωγή αποτελεσμάτων OCR ως HTML
OCR Εικόνα σε μετατροπή XHTML.
using IronOcr;varOcr = new IronTesseract();Ocr.Language = OcrLanguage.Greek; // Set the language to Greekusing (varInput = new OcrInput()){ input.Title = "Html Title"; // Set the title for the XHTML documentInput.AddImage("image1.jpeg"); // Add the image to process varResult = Ocr.Read(input); // Perform OCRResult.SaveAsHocrFile("results.html"); // Save the result as HTML}
using IronOcr;
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Greek; // Set the language to Greek
using (var Input = new OcrInput())
{
input.Title = "Html Title"; // Set the title for the XHTML document
Input.AddImage("image1.jpeg"); // Add the image to process
var Result = Ocr.Read(input); // Perform OCR
Result.SaveAsHocrFile("results.html"); // Save the result as HTML
}
ImportsIronOcrPrivateOcr = New IronTesseract()Ocr.Language = OcrLanguage.Greek' Set the language to GreekUsingInput = New OcrInput() input.Title = "Html Title" ' Set the title for the XHTML documentInput.AddImage("image1.jpeg") ' Add the image to process DimResult = Ocr.Read(input) ' Perform OCRResult.SaveAsHocrFile("results.html") ' Save the result as HTMLEndUsing
Imports IronOcr
Private Ocr = New IronTesseract()
Ocr.Language = OcrLanguage.Greek ' Set the language to Greek
Using Input = New OcrInput()
input.Title = "Html Title" ' Set the title for the XHTML document
Input.AddImage("image1.jpeg") ' Add the image to process
Dim Result = Ocr.Read(input) ' Perform OCR
Result.SaveAsHocrFile("results.html") ' Save the result as HTML
End Using
Φίλτρα βελτίωσης εικόνας OCR
Το IronOCR παρέχει μοναδικά φίλτρα για αντικείμενα OcrInput για τη βελτίωση της απόδοσης του OCR.
Παράδειγμα κώδικα βελτίωσης εικόνας
Κάνει τις εικόνες εισόδου OCR υψηλότερης ποιότητας για να παράγει καλύτερα, ταχύτερα αποτελέσματα OCR.
using IronOcr;varOcr = new IronTesseract();Ocr.Language = OcrLanguage.Greek; // Set the language to Greekusing (varInput = new OcrInput(@"LowQuality.jpeg")){Input.DeNoise(); // Corrects digital noiseInput.Deskew(); // Corrects skew and perspective varResult = Ocr.Read(Input); // Perform OCRConsole.WriteLine(Result.Text); // Output the text}
using IronOcr;
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Greek; // Set the language to Greek
using (var Input = new OcrInput(@"LowQuality.jpeg"))
{
Input.DeNoise(); // Corrects digital noise
Input.Deskew(); // Corrects skew and perspective
var Result = Ocr.Read(Input); // Perform OCR
Console.WriteLine(Result.Text); // Output the text
}
ImportsIronOcrPrivateOcr = New IronTesseract()Ocr.Language = OcrLanguage.Greek' Set the language to GreekUsingInput = New OcrInput("LowQuality.jpeg")Input.DeNoise() ' Corrects digital noiseInput.Deskew() ' Corrects skew and perspective DimResult = Ocr.Read(Input) ' Perform OCRConsole.WriteLine(Result.Text) ' Output the textEndUsing
Imports IronOcr
Private Ocr = New IronTesseract()
Ocr.Language = OcrLanguage.Greek ' Set the language to Greek
Using Input = New OcrInput("LowQuality.jpeg")
Input.DeNoise() ' Corrects digital noise
Input.Deskew() ' Corrects skew and perspective
Dim Result = Ocr.Read(Input) ' Perform OCR
Console.WriteLine(Result.Text) ' Output the text
End Using
Λίστα φίλτρων εικόνων OCR
Τα φίλτρα εισόδου για την ενίσχυση της απόδοσης OCR που είναι ενσωματωμένα στο IronOCR περιλαμβάνουν:
OcrInput.Rotate (διπλές μοίρες) - Περιστρέφει τις εικόνες κατά αριθμό μοίρες δεξιόστροφα. Για
αριστερόστροφα, χρησιμοποιήστε αρνητικούς αριθμούς.
OcrInput.Binarize () - Μετατρέπει κάθε εικονοστοιχείο ασπρόμαυρο. Μπορεί να βελτιώσει τις περιπτώσεις απόδοσης OCR με πολύ χαμηλή αντίθεση.
OcrInput.ToGrayScale () - Μετατρέπει κάθε εικονοστοιχείο σε γκρι κλίμακα. Μπορεί να βελτιώσει την ταχύτητα OCR.
OcrInput.Contrast () - Αυξάνει αυτόματα την αντίθεση και βελτιώνει την ακρίβεια σε σαρώσεις χαμηλής αντίθεσης.
OcrInput.DeNoise () - Αφαιρεί τον ψηφιακό θόρυβο.
OcrInput.Invert () - Αντιστρέφει κάθε χρώμα. Π.χ. Λευκό γίνεται μαύρο: το μαύρο γίνεται λευκό.
OcrInput.Dilate () - Προηγμένη Μορφολογία που προσθέτει pixel στα όρια των αντικειμένων σε μια εικόνα.
OcrInput.Erode () - Προηγμένη Μορφολογία που αφαιρεί τα εικονοστοιχεία στα όρια αντικειμένου.
OcrInput.Deskew () - Περιστρέφει την εικόνα ώστε να είναι ορθογώνια και με σωστό προσανατολισμό.
Οι γλώσσες περιλαμβάνουν Γερμανικά, Γαλλικά, Αγγλικά, Κινέζικα, Ιαπωνικά και πολλά άλλα. Υπάρχουν πακέτα ειδικών γλωσσών για διαβατήρια MRZ, ελέγχους MICR, Οικονομικά δεδομένα, πινακίδες κυκλοφορίας και πολλά άλλα. Μπορείτε επίσης να χρησιμοποιήσετε οποιοδήποτε αρχείο Tesseract ".traineddata" - συμπεριλαμβανομένων αυτών που δημιουργείτε μόνοι σας.
Παράδειγμα γλώσσας
Χρήση άλλων γλωσσών OCR.
// PM> Install-Package IronOcr.Languages.Arabicusing IronOcr;varOcr = new IronTesseract();Ocr.Language = OcrLanguage.Arabic; // Set OCR language to Arabicusing (var input = new OcrInput()){ input.AddImage("img/arabic.gif"); // Add image to process varResult = Ocr.Read(input); // Perform OCR // Save the result as a text file since console can't easily print Arabic textResult.SaveAsTextFile("arabic.txt");}
// PM> Install-Package IronOcr.Languages.Arabic
using IronOcr;
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Arabic; // Set OCR language to Arabic
using (var input = new OcrInput())
{
input.AddImage("img/arabic.gif"); // Add image to process
var Result = Ocr.Read(input); // Perform OCR
// Save the result as a text file since console can't easily print Arabic text
Result.SaveAsTextFile("arabic.txt");
}
' PM> Install-Package IronOcr.Languages.ArabicImportsIronOcrPrivateOcr = New IronTesseract()Ocr.Language = OcrLanguage.Arabic' Set OCR language to ArabicUsing input = New OcrInput() input.AddImage("img/arabic.gif") ' Add image to process DimResult = Ocr.Read(input) ' Perform OCR ' Save the result as a text file since console can't easily print Arabic textResult.SaveAsTextFile("arabic.txt")EndUsing
' PM> Install-Package IronOcr.Languages.Arabic
Imports IronOcr
Private Ocr = New IronTesseract()
Ocr.Language = OcrLanguage.Arabic ' Set OCR language to Arabic
Using input = New OcrInput()
input.AddImage("img/arabic.gif") ' Add image to process
Dim Result = Ocr.Read(input) ' Perform OCR
' Save the result as a text file since console can't easily print Arabic text
Result.SaveAsTextFile("arabic.txt")
End Using
Παράδειγμα πολλαπλής γλώσσας
Είναι επίσης δυνατό το OCR να χρησιμοποιεί πολλές γλώσσες ταυτόχρονα. Αυτό μπορεί πραγματικά να βοηθήσει στη λήψη μεταδεδομένων και διευθύνσεων URL στην αγγλική γλώσσα σε έγγραφα Unicode.
// PM> Install-Package IronOcr.Languages.ChineseSimplifiedusing IronOcr;varOcr = new IronTesseract();Ocr.Language = OcrLanguage.ChineseSimplified; // Set primary language to Chinese SimplifiedOcr.AddSecondaryLanguage(OcrLanguage.Greek); // Add Greek as a secondary language// Add as many languages as neededusing (var input = new OcrInput()){ input.Add("multi-language.pdf"); // Add multi-language PDF varResult = Ocr.Read(input); // Perform OCRResult.SaveAsTextFile("results.txt"); // Save result to text file}
// PM> Install-Package IronOcr.Languages.ChineseSimplified
using IronOcr;
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.ChineseSimplified; // Set primary language to Chinese Simplified
Ocr.AddSecondaryLanguage(OcrLanguage.Greek); // Add Greek as a secondary language
// Add as many languages as needed
using (var input = new OcrInput())
{
input.Add("multi-language.pdf"); // Add multi-language PDF
var Result = Ocr.Read(input); // Perform OCR
Result.SaveAsTextFile("results.txt"); // Save result to text file
}
' PM> Install-Package IronOcr.Languages.ChineseSimplifiedImportsIronOcrPrivateOcr = New IronTesseract()Ocr.Language = OcrLanguage.ChineseSimplified' Set primary language to Chinese SimplifiedOcr.AddSecondaryLanguage(OcrLanguage.Greek) ' Add Greek as a secondary language' Add as many languages as neededUsing input = New OcrInput() input.Add("multi-language.pdf") ' Add multi-language PDF DimResult = Ocr.Read(input) ' Perform OCRResult.SaveAsTextFile("results.txt") ' Save result to text fileEndUsing
' PM> Install-Package IronOcr.Languages.ChineseSimplified
Imports IronOcr
Private Ocr = New IronTesseract()
Ocr.Language = OcrLanguage.ChineseSimplified ' Set primary language to Chinese Simplified
Ocr.AddSecondaryLanguage(OcrLanguage.Greek) ' Add Greek as a secondary language
' Add as many languages as needed
Using input = New OcrInput()
input.Add("multi-language.pdf") ' Add multi-language PDF
Dim Result = Ocr.Read(input) ' Perform OCR
Result.SaveAsTextFile("results.txt") ' Save result to text file
End Using
Λεπτομερή αντικείμενα αποτελεσμάτων OCR
Το IronOCR επιστρέφει ένα αντικείμενο αποτελέσματος OCR για κάθε λειτουργία OCR. Γενικά, οι προγραμματιστές χρησιμοποιούν μόνο την ιδιότητα κειμένου αυτού του αντικειμένου για να κάνουν τη σάρωση του κειμένου από την εικόνα. Ωστόσο, τα αποτελέσματα OCR DOM είναι πολύ πιο προηγμένα από αυτό.
using IronOcr;using System.Drawing; //Προσθήκη αναφοράς συναρμολόγησηςvarOcr = new IronTesseract();Ocr.Language = OcrLanguage.Greek; // Set the language to GreekOcr.Configuration.EngineMode = TesseractEngineMode.TesseractAndLstm; // Configure engine modeOcr.Configuration.ReadBarCodes = true; // Enable barcode readingusing (varInput = new OcrInput(@"images\sample.tiff")){ OcrResultResult = Ocr.Read(Input); // Perform OCR // Access detailed result information varPages = Result.Pages; varWords = Pages[0].Words; varBarcodes = Result.Barcodes; // Εξερευνήστε εδώ για να βρείτε ένα τεράστιο, λεπτομερές API: // - Σελίδες, μπλοκ, παραφράσεις, γραμμές, λέξεις, χαρακτήρες // - Εξαγωγή εικόνας, Συντεταγμένες γραμματοσειρών, Στατιστικά δεδομένα}
using IronOcr;
using System.Drawing; //Προσθήκη αναφοράς συναρμολόγησης
var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Greek; // Set the language to Greek
Ocr.Configuration.EngineMode = TesseractEngineMode.TesseractAndLstm; // Configure engine mode
Ocr.Configuration.ReadBarCodes = true; // Enable barcode reading
using (var Input = new OcrInput(@"images\sample.tiff"))
{
OcrResult Result = Ocr.Read(Input); // Perform OCR
// Access detailed result information
var Pages = Result.Pages;
var Words = Pages[0].Words;
var Barcodes = Result.Barcodes;
// Εξερευνήστε εδώ για να βρείτε ένα τεράστιο, λεπτομερές API:
// - Σελίδες, μπλοκ, παραφράσεις, γραμμές, λέξεις, χαρακτήρες
// - Εξαγωγή εικόνας, Συντεταγμένες γραμματοσειρών, Στατιστικά δεδομένα
}
ImportsIronOcrImportsSystem.Drawing'Προσθήκη αναφοράς συναρμολόγησηςPrivateOcr = New IronTesseract()Ocr.Language = OcrLanguage.Greek' Set the language to GreekOcr.Configuration.EngineMode = TesseractEngineMode.TesseractAndLstm' Configure engine modeOcr.Configuration.ReadBarCodes = True ' Enable barcode readingUsingInput = New OcrInput("images\sample.tiff") DimResultAsOcrResult = Ocr.Read(Input) ' Perform OCR ' Access detailed result information DimPages = Result.Pages DimWords = Pages(0).Words DimBarcodes = Result.Barcodes ' Εξερευνήστε εδώ για να βρείτε ένα τεράστιο, λεπτομερές API: ' - Σελίδες, μπλοκ, παραφράσεις, γραμμές, λέξεις, χαρακτήρες ' - Εξαγωγή εικόνας, Συντεταγμένες γραμματοσειρών, Στατιστικά δεδομέναEndUsing
Imports IronOcr
Imports System.Drawing 'Προσθήκη αναφοράς συναρμολόγησης
Private Ocr = New IronTesseract()
Ocr.Language = OcrLanguage.Greek ' Set the language to Greek
Ocr.Configuration.EngineMode = TesseractEngineMode.TesseractAndLstm ' Configure engine mode
Ocr.Configuration.ReadBarCodes = True ' Enable barcode reading
Using Input = New OcrInput("images\sample.tiff")
Dim Result As OcrResult = Ocr.Read(Input) ' Perform OCR
' Access detailed result information
Dim Pages = Result.Pages
Dim Words = Pages(0).Words
Dim Barcodes = Result.Barcodes
' Εξερευνήστε εδώ για να βρείτε ένα τεράστιο, λεπτομερές API:
' - Σελίδες, μπλοκ, παραφράσεις, γραμμές, λέξεις, χαρακτήρες
' - Εξαγωγή εικόνας, Συντεταγμένες γραμματοσειρών, Στατιστικά δεδομένα
End Using
Εκτέλεση
Το IronOCR λειτουργεί έξω από το κουτί χωρίς να χρειάζεται να συντονιστείτε η απόδοση ή να τροποποιήσετε σε μεγάλο βαθμό τις εικόνες εισόδου.
Η ταχύτητα είναι απίστευτη: Το IronOCR.2020 + είναι έως και 10 φορές πιο γρήγορο και κάνει πάνω από 250% λιγότερα σφάλματα από τις προηγούμενες εκδόσεις.
Μάθε περισσότερα
Για να μάθετε περισσότερα σχετικά με το OCR σε C#, VB, F# ή σε οποιαδήποτε άλλη γλώσσα .NET, διαβάστε τα εκπαιδευτικά σεμινάρια της κοινότητάς μας, τα οποία δίνουν πραγματικά παραδείγματα για το πώς μπορεί να χρησιμοποιηθεί το IronOCR και μπορεί να δείξει τις αποχρώσεις του πώς να αξιοποιήσετε στο έπακρο αυτή την βιβλιοθήκη.
Curtis Chau holds a Bachelor’s degree in Computer Science (Carleton University) and specializes in front-end development with expertise in Node.js, TypeScript, JavaScript, and React. Passionate about crafting intuitive and aesthetically pleasing user interfaces, Curtis enjoys working with modern frameworks and creating well-structured, visually appealing manuals.