IronOCR ve Abbyy Finereader Arasında Bir Karşılaştırma
Bu makalede, PDF belgeleri ve görüntüler için OCR kullanımı konusunda yaygın iki kütüphaneyi ve uygulamayı karşılaştıracağız. Bunlar şunlardır:
- ABBYY FineReader PDF Yazılımı
- IronOCR
ABBYY Finereader SDK'yı C#'da Nasıl Kullanılır
- OCR'yi C#'da gerçekleştirmek için ABBYY Finereader SDK'yı yükleyin
- Görüntü ve PDF belgelerini Microsoft Word, aranabilir PDF, CSV ve metne dönüştürün
- PDF dosyalarından düzenlenebilir PDF oluşturun
- PDF/A-1'den PDF/A-3'e ve PDF/UA'ya kadar destek sağlar
- Her türlü belgeler üzerinde dijitalleştirme, geri alma, düzenleme, koruma, paylaşma ve işbirliği yapma için en son AI tabanlı OCR teknolojisini kullanın
1. Giriş
1.1 ABBYY FineReader PDF — Giriş ve Özellikler
ABBYY FineReader PDF, ABBYY tarafından oluşturulmuş bir optik karakter tanıma (OCR) uygulamasıdır. Görüntü belgelerini (resimler, taramalar, PDF dosyaları) ve ekran yakalamalarını Microsoft Word, Microsoft Excel, Microsoft PowerPoint, Zengin Metin Formatı, HTML, PDF/A, aranabilir PDF, CSV ve metin (düz metin) gibi düzenlenebilir dosya formatlarına dönüştürmemizi sağlar.
ABBYY FineReader, hem Windows, Linux, hem de macOS için mevcut olan bir masaüstü uygulamasıdır. Ayrıca pdf dosyaları için düzenlenebilir formatların oluşturulmasını sağlar. Adobe Acrobat ile yaptığımız gibi PDF dosyalarını da okuyabiliriz. ABBYY FineReader, taranmış belgeleri dijital iş akışlarına entegre eder.
Zaman ve çaba tasarrufu yapmak için belgeleri basit ve etkili bir şekilde yönetin ve tamamlayın. Dijital olarak oluşturulmuş veya kağıttan dönüştürülmüş olsun, her belgeyle aynı metodik şekilde çalışın. PDF'nizin metnini, tablolarını ve tam düzenini önceden dönüştürmeye gerek kalmadan değiştirebilirsiniz.
ABBYY FineReader PDF, doğrudan kağıt belgelerden veya hemen her uygulamadan bir PDF yazıcısına yazdırarak 25'ten fazla farklı dosya formatından PDF oluşturabilir. Uzun süreli arşivleme için PDF/A-1'den PDF/A-3'e kadar destek sağlanır ve PDF/UA, ekran okuyucular gibi yardım yazılımları kullanırken içeriğin erişilebilir olmasını sağlar. Ayrıca, profesyonellere dijital iş yerinde verimliliği en üst düzeye çıkarmak için güç verir.
ABBYY FineReader kullanarak, bilgileri başarıyla toplamak ve belgeleri standartlaştırmak için kendi etkileşimli PDF formlarınızı oluşturup güncelleyin. Farklı türlerde etkileşimli alanları birleştirerek, eylemler ayarlayarak, mevcut PDF formlarını düzenleyerek veya geleneksel bir PDF'ye form unsurları ekleyerek formlar oluşturun.
ABBYY FineReader, kağıt belgeleri, taramaları ve taranmış PDF'leri aranabilir PDF'lere anında dönüştürebilir, bu da belgeleri dijital arşivlerden geri almanıza ve içerdikleri bilgilere erişmenize olanak tanır. FineReader PDF, PDF/A formatının tüm uyumluluk seviyelerini ve varyantlarını, PDF/A-1'den PDF/A-3'e kadar destekler, bu da uzun süreli arşivlemek için endüstri standardıdır.
ABBYY'nin en yeni AI tabanlı OCR teknolojisi olan FineReader PDF, her türdeki belgeyi hızlı bir şekilde dijitalleştirmenizi, geri almanızı, düzenlemenizi, korumanızı, paylaşmanızı ve birlikte çalışmanızı kolaylaştırır. FineReader ayrıca, orijinal belgeleri, dönüştürülmüş PDF'leri ve görüntü dosyalarını karşılaştırmamıza yardımcı olan belge karşılaştırmasını da içerir.
1.2 IronOCR — Giriş ve Özellikler
IronOCR, .NET uygulamalarında ve Web sitelerinde fotoğraflardan ve PDF'lerden metin okuyan mühendisler için yazılım sağlar. Fotoğrafları metin ve barkodlar için tarar ve birçok dünya dilini destekler; sonra çıktıyı düz metin veya yapılandırılmış veri olarak sağlayabilir. Iron Software'den OCR kütüphanesi, MVC, Web, konsol ve masaüstü .NET uygulamalarında kullanılabilir. Ticari dağıtımlar için, geliştirme ekibinden doğrudan yardım ile lisans sağlanır.
- En son Tesseract 5 motorunu kullanarak, IronOCR herhangi bir resim veya PDF formatından metni, barkodları ve QR kodlarını okur. Bu kütüphane, masaüstü, konsol ve web uygulamalarına hızlıca OCR ekler.
- IronOCR, 125 uluslararası dili destekler. Ayrıca özelleştirilmiş dil ve kelime listelerini de destekler.
- IronOCR, 20'den fazla barkod formatını ve QR kodunu okuyabilir.
- IronOCR, çok sayfalı GIF'leri ve TIFF görüntü formatlarını destekler.
- IronOCR, düşük kaliteli taranmış görüntüler için düzeltme sağlar.
- IronOCR çoklu iş parçacığı desteğine sahiptir - bir veya daha fazla işlemi aynı anda yürütür.
- IronOCR, sayfalar, paragraflar, satırlar, kelimeler, karakterler vb. için yapılandırılmış veri çıktısı sağlayabilir.
- IronOCR, Windows, Linux, macOS gibi çeşitli işletim sistemlerini destekler.
2. Visual Studio'da Yeni Proje Oluşturma
Visual Studio yazılımını açın ve "dosya menüsüne" gidin. "yeni proje"yi seçin, sonra "Konsol Uygulaması"nı seçin.
Proje adını girin ve uygun metin kutusuna dosya yolunu seçin. Sonra, oluştur butonuna tıklayın ve aşağıdaki ekran görüntüsünde olduğu gibi gerekli .NET Framework'ü seçin.
Visual Studio projesi şimdi seçilen uygulama için yapıyı oluşturacaktır. Konsolu, Windows ve web uygulamasını seçtiyseniz, şimdi kodu girebileceğiniz ve uygulamayı oluşturup/çalıştırabileceğiniz Program.cs dosyası açılacaktır.
Sonrasında, kodu test etmek için kütüphaneyi ekleyebiliriz.
3. Kurulum
3.1 ABBYY FineReader PDF Kurulumu
ABBYY FineReader'ı buradan indirebiliriz.
Yukarıdaki görüntü, gereksinimlerinize göre indirebileceğiniz iki sürüm olduğunu, Bireysel ve İş, olduğunu göstermektedir. "ücretsiz deneme sürümünü indir" seçeneğini seçin. Sizi aşağıdaki resimdeki gibi bir forma yönlendirecektir:
EXE dosya konumunu almak için formu doldurmamız gerekecek. Dosyayı indirmek için indirme seçeneğine tıklayın.
Dosya indirildikten sonra, kurulumu başlatmak için EXE dosyasına çift tıklayabiliriz. Tamamlandığında, bir açılır mesaj gösterecek ve şimdi kullanıma hazır olacaktır.
3.2 IronOCR Kurulumu
IronOCR Kütüphanesi dört şekilde indirilebilir ve kurulabilir.
Bunlar şunlardır:
- Visual Studio Kullanarak
- Visual Studio Komut Satırı Kullanarak
- NuGet web sitesinden doğrudan indirme
- IronPDF web sitesinden doğrudan indirme
3.2.1 Visual Studio Kullanma
Visual Studio yazılımı, paketi doğrudan çözüme yüklemek için NuGet Paket Yöneticisi seçeneği sağlar. Aşağıdaki ekran görüntüsü, NuGet Paket Yöneticisi'ni nasıl açacağınızı gösterir.
NuGet web sitesinden gelen paketlerin listesini göstermek için bir arama kutusu sağlar. Paket yöneticisinde, arama anahtarı olarak IronOCR kullanmamız gerekiyor, aşağıdaki ekran görüntüsünde olduğu gibi:
Yukarıdaki görüntüden, ilgili arama öğelerinin listesini alacağız. Çözüme paketi kurmak için gerekli seçeneği seçmemiz gerekiyor.
3.2.2 Visual Studio Komut Satırı Kullanma
Visual Studio'da, Araçlar -> NuGet Paket Yöneticisi -> Paket Yöneticisi Konsolu'na gidin
Paket Yöneticisi Konsol sekmesinde aşağıdaki satırı girin:
Install-Package IronOcr
Bu komut, paketi geçerli projede indirip kuracak ve kullanıma hazır olacaktır.
3.2.3 NuGet web sitesinden doğrudan indirme
Üçüncü yol, NuGet paketini doğrudan web sitesinden indirmektir.
- Bağlantı üzerine gidin.
- Sağ taraftaki menüden paketi indir seçeneğini seçin.
- İndirilen paketi çift tıklayın. Otomatik olarak yüklenecek.
- Ardından çözümü yeniden yükleyin ve projede kullanmaya başlayın.
3.2.4 IronOCR web sitesinden doğrudan indirme
En son paketi web sitesinden doğrudan indirmek için buradaki bağlantıya tıklayın. İndirildikten sonra, projeye paketi eklemek için aşağıdaki adımları izleyin.
- Çözüm penceresinden projeye sağ tıklayın.
- Ardından, "Referans Ekle" seçeneğini seçin ve indirilen referansın konumunu tarayın.
- Ardından referansı eklemek için Tamam'a tıklayın.
4. OCR Görüntüsü
Hem IronOCR hem de ABBYY FineReader, görüntüyü metne dönüştürecek OCR teknolojisine sahiptir.
4.1 ABBYY FineReader PDF Kullanımı
ABBYY FineReader PDF uygulamasını açın, aşağıdaki resimde olduğu gibi birden çok seçenekle açılacaktır.
Sonra, OCR Editörü seçeneklerinden "Aç" seçeneğini seçin. Bu, görüntü dosyalarını seçmek için bir seçenek gösterecektir:
Bir dosya seçtikten sonra, görüntüyü düzenlenebilir metne taramayı otomatik olarak başlatacak ve ardından sonucu aşağıdaki ekran görüntüsünde olduğu gibi pencerede gösterecektir:
Yukarıdaki görüntü, kaynak görüntünün düzenlenebilir metne dönüştürüldüğünü göstermektedir. Ancak, sonuç çok doğru değildir. ABBYY FineReader PDF uygulaması tarafından bazı sayılar tanınmamaktadır. Bu, karşılaştırma pencerelerinde açıkça gösterilmektedir - sol tarafta kaynak görüntü, sağ tarafta OCR dönüştürülmüş metin bulunmaktadır.
4.2 IronOCR Kullanımı
// Create an instance of IronTesseract for OCR operations
var Ocr = new IronTesseract();
// Configure OCR language and Tesseract version
Ocr.Language = OcrLanguage.EnglishBest;
Ocr.Configuration.TesseractVersion = TesseractVersion.Tesseract5;
// Create a new OcrInput object to manage input images
using (var Input = new OcrInput())
{
// Add an image to the input for processing
Input.AddImage(@"3.png");
// Perform OCR to read text from the image
var Result = Ocr.Read(Input);
// Output the extracted text to the console
Console.WriteLine(Result.Text);
Console.ReadKey();
}
// Create an instance of IronTesseract for OCR operations
var Ocr = new IronTesseract();
// Configure OCR language and Tesseract version
Ocr.Language = OcrLanguage.EnglishBest;
Ocr.Configuration.TesseractVersion = TesseractVersion.Tesseract5;
// Create a new OcrInput object to manage input images
using (var Input = new OcrInput())
{
// Add an image to the input for processing
Input.AddImage(@"3.png");
// Perform OCR to read text from the image
var Result = Ocr.Read(Input);
// Output the extracted text to the console
Console.WriteLine(Result.Text);
Console.ReadKey();
}
' Create an instance of IronTesseract for OCR operations
Dim Ocr = New IronTesseract()
' Configure OCR language and Tesseract version
Ocr.Language = OcrLanguage.EnglishBest
Ocr.Configuration.TesseractVersion = TesseractVersion.Tesseract5
' Create a new OcrInput object to manage input images
Using Input = New OcrInput()
' Add an image to the input for processing
Input.AddImage("3.png")
' Perform OCR to read text from the image
Dim Result = Ocr.Read(Input)
' Output the extracted text to the console
Console.WriteLine(Result.Text)
Console.ReadKey()
End Using
Görüntü dosyalarını metne dönüştürmemizi sağlayan Tesseract 5 API yukarıda gösterilmiştir. Yukarıdaki kod parçasında IronTesseract'in bir örneğini oluşturuyoruz. Ayrıca, bir veya daha fazla görüntü dosyası eklememize izin verecek bir OcrInput nesnesi kullanıyoruz. OcrInput nesnesi yöntemini AddImage kullanırken, mevcut görüntünün yolunu kodun içine girmemiz gerekir. Herhangi bir sayıda görüntü eklenebilir. Daha önce oluşturduğumuz IronTesseract nesnesindeki Read fonksiyonu, görüntü dosyasını işleyip sonucu OCR sonucuna çıkartarak OCR işlemi gerçekleştirmek için kullanılabilir. Görüntülerden metin çıkartabilir ve bir dizeye dönüştürebilir.
Tesseract'i kullanarak çoklu çerçeve görüntüleri de ekleyebiliriz. AddMultiFrameTiff bu işlem için farklı bir yöntemdir. Tesseract kütüphanesi, görüntüdeki her çerçeveyi okur ve her çerçeve ayrı bir sayfa olarak işlenir. Bu süreç, görüntünün ilk çerçevesini okuyacak ve ardından tüm görüntü çerçeveleri taranana kadar bir sonraki çerçeveye geçmeye devam edecektir. Bu yöntem yalnızca tiff görüntü formatını destekler.
Yukarıdaki görüntü, IronOCR sonucunun çıktısıdır ve doğru olup verilerin doğru bir şekilde düzenlenebilir metne dönüştürüldüğünü gösterir.
5. OCR PDF Dosyası
IronOCR ve ABBYY FineReader PDF, bir PDF dosyasını düzenlenebilir metne dönüştürmeye yardımcı olur. ABBYY FineReader PDF, kullanıcıya sayfayı kaydetme, görüntüyü düzenleme, sayfayı tanıma gibi seçenekler sunar. Ayrıca txt, belge, HTML formatı gibi kaydetme seçenekleri de sunar. IronOCR da dönüştürülmüş OCR dosyalarını HTML, txt, pdf vb. formatlarda kaydetmemize olanak tanır.
5.1 ABBYY FineReader PDF Kullanımı
ABBYY FineReader PDF yazılımını açın. Bu, aşağıdaki görüntü gibi birçok seçenek sunan bir sayfa açacaktır.
Sonra, OCR Editörü seçeneklerinden "Aç" seçeneğini seçin. Bu, resim/PDF seçmek için bir seçenek gösterecektir. Ya bir PDF ya da bir resim ya da her iki dosyayı seçebiliriz.
Dosyayı seçtikten sonra, Tamam düğmesine basın. Bu, görüntüyü düzenlenebilir metne taramaya otomatik olarak başlayacak ve aşağıdaki ekran görüntüsünde gösterildiği gibi bir pencerede sonucu gösterecektir.
Yukarıdaki görüntü, kaynak PDF'nin düzenlenebilir metne dönüştüğünü göstermektedir. Ancak, sonuç tamamen doğru değildir. ABBYY FineReader PDF uygulaması tarafından bazı sayılar tanınmamaktadır. Bu, karşılaştırma pencerelerinde açıkça gösterilmektedir - sol tarafta kaynak PDF, sağ tarafta OCR dönüştürülmüş metin bulunmaktadır.
5.2 IronOCR Kullanımı
OCRInput'u PDF dosyalarını yönetmek için de kullanabiliriz. Iron Tesseract sınıfı, belgelerin her sayfasını okuyacaktır. Sonra sayfalardan metin çıkarılacaktır. Korumalı belgeleri açmaya olanak tanıyan ve dosya listemize PDF eklememize izin veren AddPdf adlı ikinci bir fonksiyon kullanarak da açabiliriz (eğer korumalıysa şifre ile). Şifre korumalı PDF belgesini nasıl açacağınızı gösteren aşağıdaki kod:
// Create an instance of IronTesseract for OCR operations
var Ocr = new IronTesseract();
// Create OcrInput to manage input PDFs
using (var Input = new OcrInput())
{
// Add a password-protected PDF to the input
Input.AddPdf("example.pdf", "password");
// Perform OCR to read text from the PDF
var Result = Ocr.Read(Input);
// Output the extracted text to the console
Console.WriteLine(Result.Text);
}
// Create an instance of IronTesseract for OCR operations
var Ocr = new IronTesseract();
// Create OcrInput to manage input PDFs
using (var Input = new OcrInput())
{
// Add a password-protected PDF to the input
Input.AddPdf("example.pdf", "password");
// Perform OCR to read text from the PDF
var Result = Ocr.Read(Input);
// Output the extracted text to the console
Console.WriteLine(Result.Text);
}
' Create an instance of IronTesseract for OCR operations
Dim Ocr = New IronTesseract()
' Create OcrInput to manage input PDFs
Using Input = New OcrInput()
' Add a password-protected PDF to the input
Input.AddPdf("example.pdf", "password")
' Perform OCR to read text from the PDF
Dim Result = Ocr.Read(Input)
' Output the extracted text to the console
Console.WriteLine(Result.Text)
End Using
Iron Tesseract tarafından sağlanan aşağıdaki yöntemler de bulunmaktadır:
AddPdfPageAddPdfPages
PDF belgesindeki tek bir sayfadan içerik okuyabilir ve çıkartabiliriz, bunu AddPdfPage kullanarak yapabiliriz. Metin çıkarmak istediğimiz sayfa numarasını belirtmemiz yeterlidir. AddPdfPages belirttiğimiz birden fazla sayfadan metin çıkartmamıza olanak tanır. IEnumerable<int> içinde sadece sayfa sayısını belirtmemiz yeterlidir. Ayrıca, dosya konumunu ve uzantısını da eklememiz gerekir. Bu, aşağıdaki kod örneğinde gösterilmiştir:
// Define numbers representing pages to extract from the PDF
IEnumerable<int> numbers = new List<int> { 2, 8, 10 };
// Create an instance of IronTesseract for OCR operations
var Ocr = new IronTesseract();
// Create OcrInput to manage input PDFs
using (var Input = new OcrInput())
{
// Add a specific page from PDF for OCR
// Input.AddPdfPage("example.pdf", 10);
// Add multiple specific pages from PDF for OCR
// Input.AddPdfPages("example.pdf", numbers);
// Perform OCR to read text from the specified pages
var Result = Ocr.Read(Input);
// Output the extracted text to the console
Console.WriteLine(Result.Text);
// Save the extracted text to a file
Result.SaveAsTextFile("ocrtext.txt");
}
// Define numbers representing pages to extract from the PDF
IEnumerable<int> numbers = new List<int> { 2, 8, 10 };
// Create an instance of IronTesseract for OCR operations
var Ocr = new IronTesseract();
// Create OcrInput to manage input PDFs
using (var Input = new OcrInput())
{
// Add a specific page from PDF for OCR
// Input.AddPdfPage("example.pdf", 10);
// Add multiple specific pages from PDF for OCR
// Input.AddPdfPages("example.pdf", numbers);
// Perform OCR to read text from the specified pages
var Result = Ocr.Read(Input);
// Output the extracted text to the console
Console.WriteLine(Result.Text);
// Save the extracted text to a file
Result.SaveAsTextFile("ocrtext.txt");
}
' Define numbers representing pages to extract from the PDF
Dim numbers As IEnumerable(Of Integer) = New List(Of Integer) From {2, 8, 10}
' Create an instance of IronTesseract for OCR operations
Dim Ocr = New IronTesseract()
' Create OcrInput to manage input PDFs
Using Input = New OcrInput()
' Add a specific page from PDF for OCR
' Input.AddPdfPage("example.pdf", 10);
' Add multiple specific pages from PDF for OCR
' Input.AddPdfPages("example.pdf", numbers);
' Perform OCR to read text from the specified pages
Dim Result = Ocr.Read(Input)
' Output the extracted text to the console
Console.WriteLine(Result.Text)
' Save the extracted text to a file
Result.SaveAsTextFile("ocrtext.txt")
End Using
SaveAsTextFile fonksiyonunu kullanarak, sonucu bir metin dosyası olarak depolayabiliriz, böylece dosyayı çıktı dizin yoluna indirebiliriz. SaveAsHocrFile kullanarak dosyayı HTML dosyası olarak da kaydedebiliriz.
6. Diğer Özellikler
6.1 ABBYY FineReader PDF Kullanımı
FineReader, kullanıcıların OCR performansını iyileştirmelerine yardımcı olan ek seçeneklere sahiptir: Metin Alanı Çiz, Resim Alanı Çiz, Tablo Alanı Çiz, Tanıma Alanı Çiz gibi. Ayrıca, uygulama kullanıcıların PDF'leri birleştirme, ayrıştırma, düzenleme gibi işlemleri tamamlamalarını sağlar.
6.2 IronOCR Kullanımı
IronOCR, taranmış belgelerden barkod ve QR kodlarını okuma imkanı veren benzersiz özelliklere sahiptir. Aşağıdaki kod, verilen bir görüntü veya belgede barkodları nasıl okuyabileceğimizi gösterir.
// Create an instance of IronTesseract for OCR operations
var Ocr = new IronTesseract();
// Configure OCR language and barcode reading
Ocr.Language = OcrLanguage.EnglishBest;
Ocr.Configuration.ReadBarCodes = true;
Ocr.Configuration.TesseractVersion = TesseractVersion.Tesseract5;
// Create OcrInput to manage input images
using (var Input = new OcrInput())
{
// Add an image containing barcodes
Input.AddImage("barcode.gif");
// Perform OCR to read text and barcodes from the image
var Result = Ocr.Read(Input);
// Iterate through detected barcodes and output their values
foreach (var Barcode in Result.Barcodes)
{
Console.WriteLine(Barcode.Value);
}
}
// Create an instance of IronTesseract for OCR operations
var Ocr = new IronTesseract();
// Configure OCR language and barcode reading
Ocr.Language = OcrLanguage.EnglishBest;
Ocr.Configuration.ReadBarCodes = true;
Ocr.Configuration.TesseractVersion = TesseractVersion.Tesseract5;
// Create OcrInput to manage input images
using (var Input = new OcrInput())
{
// Add an image containing barcodes
Input.AddImage("barcode.gif");
// Perform OCR to read text and barcodes from the image
var Result = Ocr.Read(Input);
// Iterate through detected barcodes and output their values
foreach (var Barcode in Result.Barcodes)
{
Console.WriteLine(Barcode.Value);
}
}
' Create an instance of IronTesseract for OCR operations
Dim Ocr = New IronTesseract()
' Configure OCR language and barcode reading
Ocr.Language = OcrLanguage.EnglishBest
Ocr.Configuration.ReadBarCodes = True
Ocr.Configuration.TesseractVersion = TesseractVersion.Tesseract5
' Create OcrInput to manage input images
Using Input = New OcrInput()
' Add an image containing barcodes
Input.AddImage("barcode.gif")
' Perform OCR to read text and barcodes from the image
Dim Result = Ocr.Read(Input)
' Iterate through detected barcodes and output their values
For Each Barcode In Result.Barcodes
Console.WriteLine(Barcode.Value)
Next Barcode
End Using
Yukarıdaki kod, bir görüntü veya PDF belgesinden barkodları okuma işlemini gerçekleştirir. Bir sayfadan/görüntüden birden fazla barkod okuyabilir. Barkodu okumak için, IronOCR barkodu okumada yardımcı olan benzersiz bir Ocr.Configuration.ReadBarCodes ayarına sahiptir; varsayılan değer false olarak ayarlanmıştır.
Girdiyi okuduktan sonra, veriler OCRResult adlı nesneye kaydedilecektir; Bunun Barcodes adında bir özelliği vardır ve tüm mevcut barkod verilerini bir listeye toplar. foreach döngüsünü kullanarak, tüm barkodların detaylarını birer birer alabiliriz. Ayrıca, barkodu tarayacak ve barkodun değerini okuyacak - bir işlemde iki işlem tamamlandı!
Dahası, iş parçacığı seçenekleri de desteklenir, bu da birden fazla OCR işlemini aynı anda yapabileceğimiz anlamına gelir. IronOCR ayrıca belirli bir alandan belirlenen bir bölgeyi tanıyabilir.
// Create an instance of IronTesseract for OCR operations
var Ocr = new IronTesseract();
// Create OcrInput to manage input images
using (var Input = new OcrInput())
{
// Define a specific rectangular area on the image for OCR
var ContentArea = new System.Drawing.Rectangle() { X = 215, Y = 1250, Height = 280, Width = 1335 };
// Add an image specifying the area to be processed
Input.Add("document.png", ContentArea);
// Perform OCR to read text from the specified area
var Result = Ocr.Read(Input);
// Output the extracted text to the console
Console.WriteLine(Result.Text);
}
// Create an instance of IronTesseract for OCR operations
var Ocr = new IronTesseract();
// Create OcrInput to manage input images
using (var Input = new OcrInput())
{
// Define a specific rectangular area on the image for OCR
var ContentArea = new System.Drawing.Rectangle() { X = 215, Y = 1250, Height = 280, Width = 1335 };
// Add an image specifying the area to be processed
Input.Add("document.png", ContentArea);
// Perform OCR to read text from the specified area
var Result = Ocr.Read(Input);
// Output the extracted text to the console
Console.WriteLine(Result.Text);
}
' Create an instance of IronTesseract for OCR operations
Dim Ocr = New IronTesseract()
' Create OcrInput to manage input images
Using Input = New OcrInput()
' Define a specific rectangular area on the image for OCR
Dim ContentArea = New System.Drawing.Rectangle() With {
.X = 215,
.Y = 1250,
.Height = 280,
.Width = 1335
}
' Add an image specifying the area to be processed
Input.Add("document.png", ContentArea)
' Perform OCR to read text from the specified area
Dim Result = Ocr.Read(Input)
' Output the extracted text to the console
Console.WriteLine(Result.Text)
End Using
Yukarıdaki, belirli bir bölgede OCR gerçekleştirmenin örnek kodudur. Yalnızca görüntüde veya PDF'de dikdörtgen bölgeyi belirtmemiz yeterlidir - IronOCR'daki Tesseract motoru metnin tanınmasını sağlar.
7. Sonuç
.NET Framework bağlamında IronOCR kullanırken, Tesseract basit ve kullanımı kolaydır. Fotoğrafları ve PDF belgelerini çeşitli şekillerde destekler. Ayrıca Tesseract OCR kütüphanesinin performansını artırmak için bir dizi ayar sağlar. Çeşitli diller ve aynı işlemde birden fazla dil desteklenir. Tesseract OCR hakkında daha fazla bilgi edinmek için web sitelerini ziyaret edin.
ABBYY FineReader PDF, bir resim/PDF belgesini tanımak için yapay zeka motoru kullanan bir yazılım uygulamasıdır. Ayrıca, OCR sürecinin performansını iyileştirmek için çeşitli ayarlar sağlar. Dahası, birden fazla dili seçme seçeneği sunar. ABBYY FineReader PDF, sayfa dönüştürmelerinin kullanımında bazı sınırlamalara sahiptir. Farklı işletim sistemleri için farklı fiyatlar bulunmaktadır. ABBYY FineReader PDF fiyat detayı hakkında daha fazla bilgi edinmek için buraya tıklayın.
Yaptığımız testlerde, IronOCR, ABBYY FineReader PDF'ye kıyasla güçlü bir performans sergiledi. Bu karşılaştırmada sunulan belirli test vakalarında, düşük kaliteli görüntülerdeki bazı karakterler ve sayılar FineReader tarafından doğru tanınmazken, IronOCR bu belirli senaryolar için daha doğru sonuçlar sağladı. IronOCR ayrıca barkod verilerini tanıma ve görüntülerden barkod değerlerini okuma yeteneği sunar. IronOCR paketi ömür boyu lisans sağlamakta ve devam eden bir maliyet yoktur. IronOCR paketi, tek bir fiyatta birden fazla platformu destekler. IronOCR fiyat detayı hakkında daha fazla bilgi edinmek için buraya tıklayın.
Sıkça Sorulan Sorular
IronOCR'u ABBYY FineReader'dan üstün kılan nedir?
IronOCR, doğru OCR performansı, düşük kaliteli görüntüleri işleme yeteneği ve barkod ve QR kodları okuma gibi kapsamlı özellikler sunması nedeniyle üstün kabul edilir. Ayrıca, tekrar eden maliyetleri olmayan bir ömür boyu lisans sunar, bu da onu maliyet açısından etkili kılar.
IronOCR düşük kaliteli görüntüleri nasıl ele alıyor?
IronOCR, düşük çözünürlüklü veya düşük kaliteli taranmış görüntülerin kalitesini artıran gelişmiş görüntü düzeltme özellikleri sunar, bu da OCR sonuçlarının doğruluğunu arttırır.
IronOCR hangi platformlar tarafından destekleniyor?
IronOCR, bir ömür boyu lisansla Windows, Linux ve macOS dahil olmak üzere birden çok platformu destekler.
IronOCR barkodlar üzerinde OCR yapabiliyor mu?
Evet, IronOCR, kütüphaneyi barkod değerlerini algılamak ve çıkarmak için yapılandırarak görüntülerden barkodları okuyabilir.
IronOCR'nin çoklu iş parçacığı özelliğini kullanmanın faydaları nelerdir?
IronOCR'deki çoklu iş parçacığı özelliği, birden çok OCR işleminin eşzamanlı olarak çalışmasına izin vererek performans ve işlem hızını önemli ölçüde artırır.
IronOCR hangi dilleri destekliyor?
IronOCR, global uygulamalar için çok yönlü bir araç haline getiren 125 farklı dilde OCR desteği sunar.
IronOCR'nin lisanslaması ABBYY FineReader'in lisanslamasıyla nasıl karşılaştırılır?
IronOCR, tekrar eden maliyetler olmadan bir ömür boyu lisans sunarken, ABBYY FineReader'ın fiyatlandırması işletim sistemine göre değişebilir ve sürekli maliyetler içerebilir.
IronOCR'u C# projemin içerisine nasıl entegre edebilirim?
IronOCR'u Visual Studio, Visual Studio Komut Satırı kullanarak veya NuGet web sitesinden indirerek C# projenize entegre edebilirsiniz.
IronOCR ile hangi dosya formatları dönüştürülebilir?
IronOCR, resim ve PDF'leri, Microsoft Word, Excel ve aranabilir PDF'ler de dahil olmak üzere çeşitli düzenlenebilir formatlara dönüştürebilir.
IronOCR neden QR kodlarını okumak için tercih edilir?
IronOCR, yüksek doğruluk ve geniş bir görüntü formatı ve kalite seviyesi işleme yeteneği dahil olmak üzere sağlam özellik seti nedeniyle QR kodlarını okumak için tercih edilir.

