Altbilgi içeriğine atla
DIğER BILEşENLERLE KARşıLAşTıRıN

IronOCR ve Abbyy Finereader Arasında Bir Karşılaştırma

Bu makalede, PDF belgeleri ve görüntüler için OCR kullanımı konusunda yaygın iki kütüphaneyi ve uygulamayı karşılaştıracağız. Bunlar şunlardır:

  • ABBYY FineReader PDF Yazılımı
  • IronOCR

1. Giriş

1.1 ABBYY FineReader PDF — Giriş ve Özellikler

ABBYY FineReader PDF, ABBYY tarafından oluşturulmuş bir optik karakter tanıma (OCR) uygulamasıdır. Görüntü belgelerini (resimler, taramalar, PDF dosyaları) ve ekran yakalamalarını Microsoft Word, Microsoft Excel, Microsoft PowerPoint, Zengin Metin Formatı, HTML, PDF/A, aranabilir PDF, CSV ve metin (düz metin) gibi düzenlenebilir dosya formatlarına dönüştürmemizi sağlar.

ABBYY FineReader, hem Windows, Linux, hem de macOS için mevcut olan bir masaüstü uygulamasıdır. Ayrıca pdf dosyaları için düzenlenebilir formatların oluşturulmasını sağlar. Adobe Acrobat ile yaptığımız gibi PDF dosyalarını da okuyabiliriz. ABBYY FineReader, taranmış belgeleri dijital iş akışlarına entegre eder.

Zaman ve çaba tasarrufu yapmak için belgeleri basit ve etkili bir şekilde yönetin ve tamamlayın. Dijital olarak oluşturulmuş veya kağıttan dönüştürülmüş olsun, her belgeyle aynı metodik şekilde çalışın. PDF'nizin metnini, tablolarını ve tam düzenini önceden dönüştürmeye gerek kalmadan değiştirebilirsiniz.

ABBYY FineReader PDF, doğrudan kağıt belgelerden veya hemen her uygulamadan bir PDF yazıcısına yazdırarak 25'ten fazla farklı dosya formatından PDF oluşturabilir. Uzun süreli arşivleme için PDF/A-1'den PDF/A-3'e kadar destek sağlanır ve PDF/UA, ekran okuyucular gibi yardım yazılımları kullanırken içeriğin erişilebilir olmasını sağlar. Ayrıca, profesyonellere dijital iş yerinde verimliliği en üst düzeye çıkarmak için güç verir.

ABBYY FineReader kullanarak, bilgileri başarıyla toplamak ve belgeleri standartlaştırmak için kendi etkileşimli PDF formlarınızı oluşturup güncelleyin. Farklı türlerde etkileşimli alanları birleştirerek, eylemler ayarlayarak, mevcut PDF formlarını düzenleyerek veya geleneksel bir PDF'ye form unsurları ekleyerek formlar oluşturun.

ABBYY FineReader, kağıt belgeleri, taramaları ve taranmış PDF'leri aranabilir PDF'lere anında dönüştürebilir, bu da belgeleri dijital arşivlerden geri almanıza ve içerdikleri bilgilere erişmenize olanak tanır. FineReader PDF, PDF/A formatının tüm uyumluluk seviyelerini ve varyantlarını, PDF/A-1'den PDF/A-3'e kadar destekler, bu da uzun süreli arşivlemek için endüstri standardıdır.

ABBYY'nin en yeni AI tabanlı OCR teknolojisi olan FineReader PDF, her türdeki belgeyi hızlı bir şekilde dijitalleştirmenizi, geri almanızı, düzenlemenizi, korumanızı, paylaşmanızı ve birlikte çalışmanızı kolaylaştırır. FineReader ayrıca, orijinal belgeleri, dönüştürülmüş PDF'leri ve görüntü dosyalarını karşılaştırmamıza yardımcı olan belge karşılaştırmasını da içerir.

1.2 IronOCR — Giriş ve Özellikler

IronOCR, .NET uygulamalarında ve Web sitelerinde fotoğraflardan ve PDF'lerden metin okuyan mühendisler için yazılım sağlar. Fotoğrafları metin ve barkodlar için tarar ve birçok dünya dilini destekler; sonra çıktıyı düz metin veya yapılandırılmış veri olarak sağlayabilir. Iron Software'den OCR kütüphanesi, MVC, Web, konsol ve masaüstü .NET uygulamalarında kullanılabilir. Ticari dağıtımlar için, geliştirme ekibinden doğrudan yardım ile lisans sağlanır.

  • En son Tesseract 5 motorunu kullanarak, IronOCR herhangi bir resim veya PDF formatından metni, barkodları ve QR kodlarını okur. Bu kütüphane, masaüstü, konsol ve web uygulamalarına hızlıca OCR ekler.
  • IronOCR, 125 uluslararası dili destekler. Ayrıca özelleştirilmiş dil ve kelime listelerini de destekler.
  • IronOCR, 20'den fazla barkod formatını ve QR kodunu okuyabilir.
  • IronOCR, çok sayfalı GIF'leri ve TIFF görüntü formatlarını destekler.
  • IronOCR, düşük kaliteli taranmış görüntüler için düzeltme sağlar.
  • IronOCR çoklu iş parçacığı desteğine sahiptir - bir veya daha fazla işlemi aynı anda yürütür.
  • IronOCR, sayfalar, paragraflar, satırlar, kelimeler, karakterler vb. için yapılandırılmış veri çıktısı sağlayabilir.
  • IronOCR, Windows, Linux, macOS gibi çeşitli işletim sistemlerini destekler.

2. Visual Studio'da Yeni Proje Oluşturma

Visual Studio yazılımını açın ve "dosya menüsüne" gidin. "yeni proje"yi seçin, sonra "Konsol Uygulaması"nı seçin.

Abbyy Finereader Ocr Alternatives 1 related to 2. Visual Studio'da Yeni Proje Oluşturma

Proje adını girin ve uygun metin kutusuna dosya yolunu seçin. Sonra, oluştur butonuna tıklayın ve aşağıdaki ekran görüntüsünde olduğu gibi gerekli .NET Framework'ü seçin.

Abbyy Finereader Ocr Alternatives 2 related to 2. Visual Studio'da Yeni Proje Oluşturma

Visual Studio projesi şimdi seçilen uygulama için yapıyı oluşturacaktır. Konsolu, Windows ve web uygulamasını seçtiyseniz, şimdi kodu girebileceğiniz ve uygulamayı oluşturup/çalıştırabileceğiniz Program.cs dosyası açılacaktır.

Abbyy Finereader Ocr Alternatives 3 related to 2. Visual Studio'da Yeni Proje Oluşturma

Sonrasında, kodu test etmek için kütüphaneyi ekleyebiliriz.

3. Kurulum

3.1 ABBYY FineReader PDF Kurulumu

ABBYY FineReader'ı buradan indirebiliriz.

Abbyy Finereader Ocr Alternatives 4 related to 3.1 ABBYY FineReader PDF Kurulumu

Yukarıdaki görüntü, gereksinimlerinize göre indirebileceğiniz iki sürüm olduğunu, Bireysel ve İş, olduğunu göstermektedir. "ücretsiz deneme sürümünü indir" seçeneğini seçin. Sizi aşağıdaki resimdeki gibi bir forma yönlendirecektir:

Abbyy Finereader Ocr Alternatives 5 related to 3.1 ABBYY FineReader PDF Kurulumu

EXE dosya konumunu almak için formu doldurmamız gerekecek. Dosyayı indirmek için indirme seçeneğine tıklayın.

Dosya indirildikten sonra, kurulumu başlatmak için EXE dosyasına çift tıklayabiliriz. Tamamlandığında, bir açılır mesaj gösterecek ve şimdi kullanıma hazır olacaktır.

3.2 IronOCR Kurulumu

IronOCR Kütüphanesi dört şekilde indirilebilir ve kurulabilir.

Bunlar şunlardır:

  • Visual Studio Kullanarak
  • Visual Studio Komut Satırı Kullanarak
  • NuGet web sitesinden doğrudan indirme
  • IronPDF web sitesinden doğrudan indirme

3.2.1 Visual Studio Kullanma

Visual Studio yazılımı, paketi doğrudan çözüme yüklemek için NuGet Paket Yöneticisi seçeneği sağlar. Aşağıdaki ekran görüntüsü, NuGet Paket Yöneticisi'ni nasıl açacağınızı gösterir.

Abbyy Finereader Ocr Alternatives 6 related to 3.2.1 Visual Studio Kullanma

NuGet web sitesinden gelen paketlerin listesini göstermek için bir arama kutusu sağlar. Paket yöneticisinde, arama anahtarı olarak IronOCR kullanmamız gerekiyor, aşağıdaki ekran görüntüsünde olduğu gibi:

Abbyy Finereader Ocr Alternatives 7 related to 3.2.1 Visual Studio Kullanma

Yukarıdaki görüntüden, ilgili arama öğelerinin listesini alacağız. Çözüme paketi kurmak için gerekli seçeneği seçmemiz gerekiyor.

3.2.2 Visual Studio Komut Satırı Kullanma

Visual Studio'da, Araçlar -> NuGet Paket Yöneticisi -> Paket Yöneticisi Konsolu'na gidin

Paket Yöneticisi Konsol sekmesinde aşağıdaki satırı girin:

Install-Package IronOcr

Bu komut, paketi geçerli projede indirip kuracak ve kullanıma hazır olacaktır.

3.2.3 NuGet web sitesinden doğrudan indirme

Üçüncü yol, NuGet paketini doğrudan web sitesinden indirmektir.

  • Bağlantı üzerine gidin.
  • Sağ taraftaki menüden paketi indir seçeneğini seçin.
  • İndirilen paketi çift tıklayın. Otomatik olarak yüklenecek.
  • Ardından çözümü yeniden yükleyin ve projede kullanmaya başlayın.

3.2.4 IronOCR web sitesinden doğrudan indirme

En son paketi web sitesinden doğrudan indirmek için buradaki bağlantıya tıklayın. İndirildikten sonra, projeye paketi eklemek için aşağıdaki adımları izleyin.

  • Çözüm penceresinden projeye sağ tıklayın.
  • Ardından, "Referans Ekle" seçeneğini seçin ve indirilen referansın konumunu tarayın.
  • Ardından referansı eklemek için Tamam'a tıklayın.

4. OCR Görüntüsü

Hem IronOCR hem de ABBYY FineReader, görüntüyü metne dönüştürecek OCR teknolojisine sahiptir.

4.1 ABBYY FineReader PDF Kullanımı

ABBYY FineReader PDF uygulamasını açın, aşağıdaki resimde olduğu gibi birden çok seçenekle açılacaktır.

Abbyy Finereader Ocr Alternatives 8 related to 4.1 ABBYY FineReader PDF Kullanımı

Sonra, OCR Editörü seçeneklerinden "Aç" seçeneğini seçin. Bu, görüntü dosyalarını seçmek için bir seçenek gösterecektir:

Abbyy Finereader Ocr Alternatives 9 related to 4.1 ABBYY FineReader PDF Kullanımı

Bir dosya seçtikten sonra, görüntüyü düzenlenebilir metne taramayı otomatik olarak başlatacak ve ardından sonucu aşağıdaki ekran görüntüsünde olduğu gibi pencerede gösterecektir:

Abbyy Finereader Ocr Alternatives 10 related to 4.1 ABBYY FineReader PDF Kullanımı

Yukarıdaki görüntü, kaynak görüntünün düzenlenebilir metne dönüştürüldüğünü göstermektedir. Ancak, sonuç çok doğru değildir. ABBYY FineReader PDF uygulaması tarafından bazı sayılar tanınmamaktadır. Bu, karşılaştırma pencerelerinde açıkça gösterilmektedir - sol tarafta kaynak görüntü, sağ tarafta OCR dönüştürülmüş metin bulunmaktadır.

4.2 IronOCR Kullanımı

// Create an instance of IronTesseract for OCR operations
var Ocr = new IronTesseract();

// Configure OCR language and Tesseract version
Ocr.Language = OcrLanguage.EnglishBest;
Ocr.Configuration.TesseractVersion = TesseractVersion.Tesseract5;

// Create a new OcrInput object to manage input images
using (var Input = new OcrInput())
{
    // Add an image to the input for processing
    Input.AddImage(@"3.png");

    // Perform OCR to read text from the image
    var Result = Ocr.Read(Input);

    // Output the extracted text to the console
    Console.WriteLine(Result.Text);
    Console.ReadKey();
}
// Create an instance of IronTesseract for OCR operations
var Ocr = new IronTesseract();

// Configure OCR language and Tesseract version
Ocr.Language = OcrLanguage.EnglishBest;
Ocr.Configuration.TesseractVersion = TesseractVersion.Tesseract5;

// Create a new OcrInput object to manage input images
using (var Input = new OcrInput())
{
    // Add an image to the input for processing
    Input.AddImage(@"3.png");

    // Perform OCR to read text from the image
    var Result = Ocr.Read(Input);

    // Output the extracted text to the console
    Console.WriteLine(Result.Text);
    Console.ReadKey();
}
' Create an instance of IronTesseract for OCR operations
Dim Ocr = New IronTesseract()

' Configure OCR language and Tesseract version
Ocr.Language = OcrLanguage.EnglishBest
Ocr.Configuration.TesseractVersion = TesseractVersion.Tesseract5

' Create a new OcrInput object to manage input images
Using Input = New OcrInput()
	' Add an image to the input for processing
	Input.AddImage("3.png")

	' Perform OCR to read text from the image
	Dim Result = Ocr.Read(Input)

	' Output the extracted text to the console
	Console.WriteLine(Result.Text)
	Console.ReadKey()
End Using
$vbLabelText   $csharpLabel

Görüntü dosyalarını metne dönüştürmemizi sağlayan Tesseract 5 API yukarıda gösterilmiştir. Yukarıdaki kod parçasında IronTesseract'in bir örneğini oluşturuyoruz. Ayrıca, bir veya daha fazla görüntü dosyası eklememize izin verecek bir OcrInput nesnesi kullanıyoruz. OcrInput nesnesi yöntemini AddImage kullanırken, mevcut görüntünün yolunu kodun içine girmemiz gerekir. Herhangi bir sayıda görüntü eklenebilir. Daha önce oluşturduğumuz IronTesseract nesnesindeki Read fonksiyonu, görüntü dosyasını işleyip sonucu OCR sonucuna çıkartarak OCR işlemi gerçekleştirmek için kullanılabilir. Görüntülerden metin çıkartabilir ve bir dizeye dönüştürebilir.

Tesseract'i kullanarak çoklu çerçeve görüntüleri de ekleyebiliriz. AddMultiFrameTiff bu işlem için farklı bir yöntemdir. Tesseract kütüphanesi, görüntüdeki her çerçeveyi okur ve her çerçeve ayrı bir sayfa olarak işlenir. Bu süreç, görüntünün ilk çerçevesini okuyacak ve ardından tüm görüntü çerçeveleri taranana kadar bir sonraki çerçeveye geçmeye devam edecektir. Bu yöntem yalnızca tiff görüntü formatını destekler.

Abbyy Finereader Ocr Alternatives 11 related to 4.2 IronOCR Kullanımı

Yukarıdaki görüntü, IronOCR sonucunun çıktısıdır ve doğru olup verilerin doğru bir şekilde düzenlenebilir metne dönüştürüldüğünü gösterir.

5. OCR PDF Dosyası

IronOCR ve ABBYY FineReader PDF, bir PDF dosyasını düzenlenebilir metne dönüştürmeye yardımcı olur. ABBYY FineReader PDF, kullanıcıya sayfayı kaydetme, görüntüyü düzenleme, sayfayı tanıma gibi seçenekler sunar. Ayrıca txt, belge, HTML formatı gibi kaydetme seçenekleri de sunar. IronOCR da dönüştürülmüş OCR dosyalarını HTML, txt, pdf vb. formatlarda kaydetmemize olanak tanır.

5.1 ABBYY FineReader PDF Kullanımı

ABBYY FineReader PDF yazılımını açın. Bu, aşağıdaki görüntü gibi birçok seçenek sunan bir sayfa açacaktır.

Abbyy Finereader Ocr Alternatives 12 related to 5.1 ABBYY FineReader PDF Kullanımı

Sonra, OCR Editörü seçeneklerinden "Aç" seçeneğini seçin. Bu, resim/PDF seçmek için bir seçenek gösterecektir. Ya bir PDF ya da bir resim ya da her iki dosyayı seçebiliriz.

Abbyy Finereader Ocr Alternatives 13 related to 5.1 ABBYY FineReader PDF Kullanımı

Dosyayı seçtikten sonra, Tamam düğmesine basın. Bu, görüntüyü düzenlenebilir metne taramaya otomatik olarak başlayacak ve aşağıdaki ekran görüntüsünde gösterildiği gibi bir pencerede sonucu gösterecektir.

Abbyy Finereader Ocr Alternatives 14 related to 5.1 ABBYY FineReader PDF Kullanımı

Yukarıdaki görüntü, kaynak PDF'nin düzenlenebilir metne dönüştüğünü göstermektedir. Ancak, sonuç tamamen doğru değildir. ABBYY FineReader PDF uygulaması tarafından bazı sayılar tanınmamaktadır. Bu, karşılaştırma pencerelerinde açıkça gösterilmektedir - sol tarafta kaynak PDF, sağ tarafta OCR dönüştürülmüş metin bulunmaktadır.

5.2 IronOCR Kullanımı

OCRInput'u PDF dosyalarını yönetmek için de kullanabiliriz. Iron Tesseract sınıfı, belgelerin her sayfasını okuyacaktır. Sonra sayfalardan metin çıkarılacaktır. Korumalı belgeleri açmaya olanak tanıyan ve dosya listemize PDF eklememize izin veren AddPdf adlı ikinci bir fonksiyon kullanarak da açabiliriz (eğer korumalıysa şifre ile). Şifre korumalı PDF belgesini nasıl açacağınızı gösteren aşağıdaki kod:

// Create an instance of IronTesseract for OCR operations
var Ocr = new IronTesseract();

// Create OcrInput to manage input PDFs
using (var Input = new OcrInput())
{
    // Add a password-protected PDF to the input
    Input.AddPdf("example.pdf", "password");

    // Perform OCR to read text from the PDF
    var Result = Ocr.Read(Input);

    // Output the extracted text to the console
    Console.WriteLine(Result.Text);
}
// Create an instance of IronTesseract for OCR operations
var Ocr = new IronTesseract();

// Create OcrInput to manage input PDFs
using (var Input = new OcrInput())
{
    // Add a password-protected PDF to the input
    Input.AddPdf("example.pdf", "password");

    // Perform OCR to read text from the PDF
    var Result = Ocr.Read(Input);

    // Output the extracted text to the console
    Console.WriteLine(Result.Text);
}
' Create an instance of IronTesseract for OCR operations
Dim Ocr = New IronTesseract()

' Create OcrInput to manage input PDFs
Using Input = New OcrInput()
	' Add a password-protected PDF to the input
	Input.AddPdf("example.pdf", "password")

	' Perform OCR to read text from the PDF
	Dim Result = Ocr.Read(Input)

	' Output the extracted text to the console
	Console.WriteLine(Result.Text)
End Using
$vbLabelText   $csharpLabel

Iron Tesseract tarafından sağlanan aşağıdaki yöntemler de bulunmaktadır:

  • AddPdfPage
  • AddPdfPages

PDF belgesindeki tek bir sayfadan içerik okuyabilir ve çıkartabiliriz, bunu AddPdfPage kullanarak yapabiliriz. Metin çıkarmak istediğimiz sayfa numarasını belirtmemiz yeterlidir. AddPdfPages belirttiğimiz birden fazla sayfadan metin çıkartmamıza olanak tanır. IEnumerable<int> içinde sadece sayfa sayısını belirtmemiz yeterlidir. Ayrıca, dosya konumunu ve uzantısını da eklememiz gerekir. Bu, aşağıdaki kod örneğinde gösterilmiştir:

// Define numbers representing pages to extract from the PDF
IEnumerable<int> numbers = new List<int> { 2, 8, 10 };

// Create an instance of IronTesseract for OCR operations
var Ocr = new IronTesseract();

// Create OcrInput to manage input PDFs
using (var Input = new OcrInput())
{
    // Add a specific page from PDF for OCR
    // Input.AddPdfPage("example.pdf", 10);

    // Add multiple specific pages from PDF for OCR
    // Input.AddPdfPages("example.pdf", numbers);

    // Perform OCR to read text from the specified pages
    var Result = Ocr.Read(Input);

    // Output the extracted text to the console
    Console.WriteLine(Result.Text);

    // Save the extracted text to a file
    Result.SaveAsTextFile("ocrtext.txt");
}
// Define numbers representing pages to extract from the PDF
IEnumerable<int> numbers = new List<int> { 2, 8, 10 };

// Create an instance of IronTesseract for OCR operations
var Ocr = new IronTesseract();

// Create OcrInput to manage input PDFs
using (var Input = new OcrInput())
{
    // Add a specific page from PDF for OCR
    // Input.AddPdfPage("example.pdf", 10);

    // Add multiple specific pages from PDF for OCR
    // Input.AddPdfPages("example.pdf", numbers);

    // Perform OCR to read text from the specified pages
    var Result = Ocr.Read(Input);

    // Output the extracted text to the console
    Console.WriteLine(Result.Text);

    // Save the extracted text to a file
    Result.SaveAsTextFile("ocrtext.txt");
}
' Define numbers representing pages to extract from the PDF
Dim numbers As IEnumerable(Of Integer) = New List(Of Integer) From {2, 8, 10}

' Create an instance of IronTesseract for OCR operations
Dim Ocr = New IronTesseract()

' Create OcrInput to manage input PDFs
Using Input = New OcrInput()
	' Add a specific page from PDF for OCR
	' Input.AddPdfPage("example.pdf", 10);

	' Add multiple specific pages from PDF for OCR
	' Input.AddPdfPages("example.pdf", numbers);

	' Perform OCR to read text from the specified pages
	Dim Result = Ocr.Read(Input)

	' Output the extracted text to the console
	Console.WriteLine(Result.Text)

	' Save the extracted text to a file
	Result.SaveAsTextFile("ocrtext.txt")
End Using
$vbLabelText   $csharpLabel

SaveAsTextFile fonksiyonunu kullanarak, sonucu bir metin dosyası olarak depolayabiliriz, böylece dosyayı çıktı dizin yoluna indirebiliriz. SaveAsHocrFile kullanarak dosyayı HTML dosyası olarak da kaydedebiliriz.

6. Diğer Özellikler

6.1 ABBYY FineReader PDF Kullanımı

FineReader, kullanıcıların OCR performansını iyileştirmelerine yardımcı olan ek seçeneklere sahiptir: Metin Alanı Çiz, Resim Alanı Çiz, Tablo Alanı Çiz, Tanıma Alanı Çiz gibi. Ayrıca, uygulama kullanıcıların PDF'leri birleştirme, ayrıştırma, düzenleme gibi işlemleri tamamlamalarını sağlar.

6.2 IronOCR Kullanımı

IronOCR, taranmış belgelerden barkod ve QR kodlarını okuma imkanı veren benzersiz özelliklere sahiptir. Aşağıdaki kod, verilen bir görüntü veya belgede barkodları nasıl okuyabileceğimizi gösterir.

// Create an instance of IronTesseract for OCR operations
var Ocr = new IronTesseract();

// Configure OCR language and barcode reading
Ocr.Language = OcrLanguage.EnglishBest;
Ocr.Configuration.ReadBarCodes = true;
Ocr.Configuration.TesseractVersion = TesseractVersion.Tesseract5;

// Create OcrInput to manage input images
using (var Input = new OcrInput())
{
    // Add an image containing barcodes
    Input.AddImage("barcode.gif");

    // Perform OCR to read text and barcodes from the image
    var Result = Ocr.Read(Input);

    // Iterate through detected barcodes and output their values
    foreach (var Barcode in Result.Barcodes)
    {
        Console.WriteLine(Barcode.Value);
    }
}
// Create an instance of IronTesseract for OCR operations
var Ocr = new IronTesseract();

// Configure OCR language and barcode reading
Ocr.Language = OcrLanguage.EnglishBest;
Ocr.Configuration.ReadBarCodes = true;
Ocr.Configuration.TesseractVersion = TesseractVersion.Tesseract5;

// Create OcrInput to manage input images
using (var Input = new OcrInput())
{
    // Add an image containing barcodes
    Input.AddImage("barcode.gif");

    // Perform OCR to read text and barcodes from the image
    var Result = Ocr.Read(Input);

    // Iterate through detected barcodes and output their values
    foreach (var Barcode in Result.Barcodes)
    {
        Console.WriteLine(Barcode.Value);
    }
}
' Create an instance of IronTesseract for OCR operations
Dim Ocr = New IronTesseract()

' Configure OCR language and barcode reading
Ocr.Language = OcrLanguage.EnglishBest
Ocr.Configuration.ReadBarCodes = True
Ocr.Configuration.TesseractVersion = TesseractVersion.Tesseract5

' Create OcrInput to manage input images
Using Input = New OcrInput()
	' Add an image containing barcodes
	Input.AddImage("barcode.gif")

	' Perform OCR to read text and barcodes from the image
	Dim Result = Ocr.Read(Input)

	' Iterate through detected barcodes and output their values
	For Each Barcode In Result.Barcodes
		Console.WriteLine(Barcode.Value)
	Next Barcode
End Using
$vbLabelText   $csharpLabel

Yukarıdaki kod, bir görüntü veya PDF belgesinden barkodları okuma işlemini gerçekleştirir. Bir sayfadan/görüntüden birden fazla barkod okuyabilir. Barkodu okumak için, IronOCR barkodu okumada yardımcı olan benzersiz bir Ocr.Configuration.ReadBarCodes ayarına sahiptir; varsayılan değer false olarak ayarlanmıştır.

Girdiyi okuduktan sonra, veriler OCRResult adlı nesneye kaydedilecektir; Bunun Barcodes adında bir özelliği vardır ve tüm mevcut barkod verilerini bir listeye toplar. foreach döngüsünü kullanarak, tüm barkodların detaylarını birer birer alabiliriz. Ayrıca, barkodu tarayacak ve barkodun değerini okuyacak - bir işlemde iki işlem tamamlandı!

Dahası, iş parçacığı seçenekleri de desteklenir, bu da birden fazla OCR işlemini aynı anda yapabileceğimiz anlamına gelir. IronOCR ayrıca belirli bir alandan belirlenen bir bölgeyi tanıyabilir.

// Create an instance of IronTesseract for OCR operations
var Ocr = new IronTesseract();

// Create OcrInput to manage input images
using (var Input = new OcrInput())
{
    // Define a specific rectangular area on the image for OCR
    var ContentArea = new System.Drawing.Rectangle() { X = 215, Y = 1250, Height = 280, Width = 1335 };

    // Add an image specifying the area to be processed
    Input.Add("document.png", ContentArea);

    // Perform OCR to read text from the specified area
    var Result = Ocr.Read(Input);

    // Output the extracted text to the console
    Console.WriteLine(Result.Text);
}
// Create an instance of IronTesseract for OCR operations
var Ocr = new IronTesseract();

// Create OcrInput to manage input images
using (var Input = new OcrInput())
{
    // Define a specific rectangular area on the image for OCR
    var ContentArea = new System.Drawing.Rectangle() { X = 215, Y = 1250, Height = 280, Width = 1335 };

    // Add an image specifying the area to be processed
    Input.Add("document.png", ContentArea);

    // Perform OCR to read text from the specified area
    var Result = Ocr.Read(Input);

    // Output the extracted text to the console
    Console.WriteLine(Result.Text);
}
' Create an instance of IronTesseract for OCR operations
Dim Ocr = New IronTesseract()

' Create OcrInput to manage input images
Using Input = New OcrInput()
	' Define a specific rectangular area on the image for OCR
	Dim ContentArea = New System.Drawing.Rectangle() With {
		.X = 215,
		.Y = 1250,
		.Height = 280,
		.Width = 1335
	}

	' Add an image specifying the area to be processed
	Input.Add("document.png", ContentArea)

	' Perform OCR to read text from the specified area
	Dim Result = Ocr.Read(Input)

	' Output the extracted text to the console
	Console.WriteLine(Result.Text)
End Using
$vbLabelText   $csharpLabel

Yukarıdaki, belirli bir bölgede OCR gerçekleştirmenin örnek kodudur. Yalnızca görüntüde veya PDF'de dikdörtgen bölgeyi belirtmemiz yeterlidir - IronOCR'daki Tesseract motoru metnin tanınmasını sağlar.

7. Sonuç

.NET Framework bağlamında IronOCR kullanırken, Tesseract basit ve kullanımı kolaydır. Fotoğrafları ve PDF belgelerini çeşitli şekillerde destekler. Ayrıca Tesseract OCR kütüphanesinin performansını artırmak için bir dizi ayar sağlar. Çeşitli diller ve aynı işlemde birden fazla dil desteklenir. Tesseract OCR hakkında daha fazla bilgi edinmek için web sitelerini ziyaret edin.

ABBYY FineReader PDF, bir resim/PDF belgesini tanımak için yapay zeka motoru kullanan bir yazılım uygulamasıdır. Ayrıca, OCR sürecinin performansını iyileştirmek için çeşitli ayarlar sağlar. Dahası, birden fazla dili seçme seçeneği sunar. ABBYY FineReader PDF, sayfa dönüştürmelerinin kullanımında bazı sınırlamalara sahiptir. Farklı işletim sistemleri için farklı fiyatlar bulunmaktadır. ABBYY FineReader PDF fiyat detayı hakkında daha fazla bilgi edinmek için buraya tıklayın.

Yaptığımız testlerde, IronOCR, ABBYY FineReader PDF'ye kıyasla güçlü bir performans sergiledi. Bu karşılaştırmada sunulan belirli test vakalarında, düşük kaliteli görüntülerdeki bazı karakterler ve sayılar FineReader tarafından doğru tanınmazken, IronOCR bu belirli senaryolar için daha doğru sonuçlar sağladı. IronOCR ayrıca barkod verilerini tanıma ve görüntülerden barkod değerlerini okuma yeteneği sunar. IronOCR paketi ömür boyu lisans sağlamakta ve devam eden bir maliyet yoktur. IronOCR paketi, tek bir fiyatta birden fazla platformu destekler. IronOCR fiyat detayı hakkında daha fazla bilgi edinmek için buraya tıklayın.

Lütfen dikkate alınABBYY FineReader PDF Yazılımı, ilgili sahibinin tescilli markasıdır. Bu site, ABBYY FineReader PDF Yazılımı ile bağlı, onaylanmış veya sponsorlu değildir. Tüm ürün adları, logolar ve markalar kendi sahiplerine aittir. Karşılaştırmalar, yalnızca bilgilendirme amaçlıdır ve yazı sırasında halka açık bilgilerle alakalı olarak yansıtılmaktadır.

Sıkça Sorulan Sorular

IronOCR'u ABBYY FineReader'dan üstün kılan nedir?

IronOCR, doğru OCR performansı, düşük kaliteli görüntüleri işleme yeteneği ve barkod ve QR kodları okuma gibi kapsamlı özellikler sunması nedeniyle üstün kabul edilir. Ayrıca, tekrar eden maliyetleri olmayan bir ömür boyu lisans sunar, bu da onu maliyet açısından etkili kılar.

IronOCR düşük kaliteli görüntüleri nasıl ele alıyor?

IronOCR, düşük çözünürlüklü veya düşük kaliteli taranmış görüntülerin kalitesini artıran gelişmiş görüntü düzeltme özellikleri sunar, bu da OCR sonuçlarının doğruluğunu arttırır.

IronOCR hangi platformlar tarafından destekleniyor?

IronOCR, bir ömür boyu lisansla Windows, Linux ve macOS dahil olmak üzere birden çok platformu destekler.

IronOCR barkodlar üzerinde OCR yapabiliyor mu?

Evet, IronOCR, kütüphaneyi barkod değerlerini algılamak ve çıkarmak için yapılandırarak görüntülerden barkodları okuyabilir.

IronOCR'nin çoklu iş parçacığı özelliğini kullanmanın faydaları nelerdir?

IronOCR'deki çoklu iş parçacığı özelliği, birden çok OCR işleminin eşzamanlı olarak çalışmasına izin vererek performans ve işlem hızını önemli ölçüde artırır.

IronOCR hangi dilleri destekliyor?

IronOCR, global uygulamalar için çok yönlü bir araç haline getiren 125 farklı dilde OCR desteği sunar.

IronOCR'nin lisanslaması ABBYY FineReader'in lisanslamasıyla nasıl karşılaştırılır?

IronOCR, tekrar eden maliyetler olmadan bir ömür boyu lisans sunarken, ABBYY FineReader'ın fiyatlandırması işletim sistemine göre değişebilir ve sürekli maliyetler içerebilir.

IronOCR'u C# projemin içerisine nasıl entegre edebilirim?

IronOCR'u Visual Studio, Visual Studio Komut Satırı kullanarak veya NuGet web sitesinden indirerek C# projenize entegre edebilirsiniz.

IronOCR ile hangi dosya formatları dönüştürülebilir?

IronOCR, resim ve PDF'leri, Microsoft Word, Excel ve aranabilir PDF'ler de dahil olmak üzere çeşitli düzenlenebilir formatlara dönüştürebilir.

IronOCR neden QR kodlarını okumak için tercih edilir?

IronOCR, yüksek doğruluk ve geniş bir görüntü formatı ve kalite seviyesi işleme yeteneği dahil olmak üzere sağlam özellik seti nedeniyle QR kodlarını okumak için tercih edilir.

Curtis Chau
Teknik Yazar

Curtis Chau, Bilgisayar Bilimleri alanında Lisans Derecesine (Carleton Üniversitesi) sahip ve Node.js, TypeScript, JavaScript ve React konularında uzmanlaşmış ön uç geliştirmeyle ilgileniyor. Sezgisel ve estetik açıdan hoş kullanıcı arayüzleri oluşturma tutkunu, Curtis modern çerçevelerle çalışmayı ve iyi yapı...

Daha Fazla Oku

Iron Destek Ekibi

Haftada 5 gün, 24 saat çevrimiçiyiz.
Sohbet
E-posta
Beni Ara