Altbilgi içeriğine atla
DIğER BILEşENLERLE KARşıLAşTıRıN

IronOCR ve AWS Textract OCR Arasında Karşılaştırma

OCR Nedir?

Metin içeren bir görüntüyü makine tarafından okunabilir bir metin formatına dönüştürmek için kullanılan prosedür, Optik Karakter Tanıma (OCR) olarak bilinir. Örneğin, bir form, fatura veya makbuzu taradığınızda, bilgisayarınız taramayı bir görüntü dosyası olarak kaydeder. Görüntü dosyasındaki veriler bir metin editörü kullanılarak düzenlenemez, aranamaz veya sayılmaz. Ancak, görüntü dosyasını metin belgesine dönüştürmek ve içeriğini metin verisi olarak saklamak için OCR çözümleri kullanabilirsiniz.

Bu modern çağda, çoğu iş akışı, bilgiyi baskıdan almaktadır. Kağıt formlar, faturalar, taranmış yasal belgeler, tablo çekim ve basılı metin veya sözleşmeler gibi farklı belgeler iş süreçlerinin bir parçasıdır. Ayrıca, böyle dokümantasyon içeriğini dijitalleştirmek, metni içinde gizli olan görüntüler oluşturur. Görüntülerdeki metin, kelime işleme araçları tarafından metin belgeleri gibi işlenemez. OCR teknolojisi, metin görüntülerini diğer iş yazılımları tarafından analiz edilebilecek metin verisine dönüştürerek sorunu çözer.

OCR Nasıl Çalışır?

OCR motoru, aşağıdaki adımları kullanarak çalışır:

Görüntü Elde Etme

Bu süreçte bir tarayıcı belgeleri okur ve onları ikili verilere dönüştürür. OCR yazılımı taranan görüntüyü tanımlar ve ışık alanlarını arka plan olarak, karanlık alanları ise metin olarak sınıflandırır.

Ön İşleme

OCR yazılımı önce görüntüyü temizler ve okuma için verilerini hazırlamak için hataları giderir.

Metin Tanıma

Metin tanıma için iki ana OCR algoritması türü, desen eşleştirme ve özellik ekstraksiyonudur.

Desen Eşleştirme

Desen eşleştirme sürecinde bir karakter resmi, veya glif, izole edilir ve önceden kaydedilmiş bir glifle karşılaştırılır.

Özellik Çıkarımı

Özellik çıkarımı süreci sırasında glifler, çizgiler, kapalı halkalar, çizgi yönü ve çizgi kavşakları gibi özelliklere ayrılır.

Son İşleme

Teknoloji, analizden sonra alınan metin verisini dijital bir dosya haline dönüştürür. Bazı OCR sistemleri, taranmış belgenin hem öncesini hem de sonrasını içeren açıklamalı PDF belgeleri oluşturabilir.

Bu makale, OCR için en yaygın uygulama ve belge kütüphanelerinden ikisi arasındaki karşılaştırmayı tartışacak:

  • IronOCR
  • AWS OCR Textract

IronOCR Kütüphanesi

IronOCR, tarama, arama, resim ve PDF okuma hizmetleri sunan bir C# .NET kütüphanesidir. 125'den fazla global dil paketleri ile birlikte gelmektedir. Çıktı, metin, yapılandırılmış veri ya da aranabilir PDF olarak elde edilir. .NET versiyonlarını destekler: 6, 5, Core, Standard ve Framework.

IronOCR, kusurlu bir şekilde taranmış görüntülerden ve belgelerden veriyi otomatik olarak tespit etme ve çıkarma yeteneği ile benzersizdir. 'IronTesseract' Sınıfı, en basit API'ye sahiptir. Herhangi bir platformda, en hızlı, en doğru ve yerel DLL ve API ile bilinen en gelişmiş Tesseract yapısını sunar.

IronOCR ayrıca tüm görüntü formatlarından barkod ve QR kodlarını da tarayabilir ve en son Tesseract 5 motorunu kullanarak metin okumaları ve PDF taramaları gerçekleştirebilir.

Özellikler

Sadece .NET uygulamaları için yapılmıştır. 125 farklı dili destekleyebilir. IronOCR tarafından Arapça, Çince, İngilizce, Fince, Fransızca, Almanca, Japonca ve birçok diğer dil desteklenir.

  • Bir görüntünün eğimli konumunu düzeltebilir ve kesin çıktılar için görüntüden parazitleri kaldırabilir. Düşük çözünürlüklü ve düşük DPI'lı görüntülerde olağanüstü performans gösterir. Birden fazla türde QR kodu ve barkodu okuyabilir.
  • Gif ve Tiff formatlarını da destekler.
  • Birçok iş parçacığını aynı anda çalıştırmasına olanak tanır. Bu, diğer OCR kütüphanelerinde bulunmayan olağanüstü bir özelliktir. Süreçleri daha pürüzsüz hale getirir. Kolayca PDF dosyaları üzerinde OCR gerçekleştirebilir ve OCR kullanarak aranabilir PDF belgeleri dışa aktarabilir.

Şimdi, AWS OCR'a bir göz atalım.

AWS OCR Textract

Amazon'un AWS Textract, taranmış belgelerden metin ve veri otomatik olarak çıkaran bir makine öğrenimi (ML) hizmetidir. Derin öğrenme teknolojisini kullanarak formlar ve tablolardan veri tanımlama, anlama ve çıkarma işlemleri yapmak için basit optik karakter tanıma (OCR) ötesine geçer.

AWS OCR Textract, herhangi bir belge türünü okumak ve işlemek için makine öğrenimini kullanır, manuel çaba gerektirmeden metni, tablolara ait verileri ve diğer verileri doğru bir şekilde çıkarır. Verileri çıkarmak saatler veya günler almak yerine, Textract bunu hızlı bir şekilde yapabilir. Ayrıca, modellerinizin denetlenmesi ve hassas verilerin kontrolü için Amazon Artırılmış Yapay Zeka (AI) ile insan değerlendirmeleri ekleyebilirsiniz.

Özellikler

  • Finansal raporlar, tıbbi kayıtlar, tablolar ve vergi formları dahil olmak üzere çeşitli belgelerde metin tespit edin.
  • Belgelerden metin, form ve tablo verilerini, yapılandırılmış veri kullanarak belge analizi API'si ile çıkarın.
  • Analyze Document API içindeki Queries özelliğini kullanarak belgelerden bilgi belirleyin ve çıkarın. Faturaları ve makbuzları Analyze Expense API ile işleyin.
  • ABD tarafından verilen sürücü belgeleri ve pasaportlar gibi kimlik belgelerini işleyin government, Analyze ID API kullanarak.
  • Karar alma süreçlerini hızlandırabilecek ölçeklenebilir belge analizi.

Makalenin geri kalanı şu şekildedir:

  1. Visual Studio Projesi Oluşturma
  2. IronOCR'un Kurulumu
  3. AWS OCR Textract Kurulumu
  4. PDF'den Metne
  5. Görüntüden Metne
  6. Barkod ve QR'den Metne
  7. Lisanslama
  8. Sonuç

1. Visual Studio Projesi Oluşturma

Bu öğretici Visual Studio 2022 sürümünü kullanacak, bu yüzden yüklü olduğunu varsayıyorum.

  • Visual Studio 2022'yi açın.
  • Yeni bir .NET Core projesi oluşturun ve ardından Console App'i seçin.
Aws Ocr Alternatives 1 related to 1. Visual Studio Projesi Oluşturma

Konsol Uygulaması

  • Projeye bir ad verin. Örneğin, TextReader.
  • .NET framework'in en son ve en kararlı sürümü 6.0. Bunu kullanacağız.

    .NET Framework

  • Oluştur düğmesine tıklayın ve proje oluşturulacaktır.

Sonraki adımda, kullanacağımız kütüphaneleri teker teker yükleyeceğiz.

2. IronOCR'nin Kurulumu

IronOCR kütüphanesi dört şekilde indirilebilir ve yüklenebilir. Bunlar aşağıdaki gibi:

  1. Visual Studio NuGet Paket Yöneticisi kullanarak.
  2. NuGet web sitesi üzerinden doğrudan indirme.
  3. IronOCR web sayfası üzerinden doğrudan indirme.
  4. Visual Studio'da Komut Satırını Kullanma.

2.1. Visual Studio NuGet Yöneticisini Kullanma

Visual Studio NuGet Paket Yöneticisi, IronOCR'u bir C# projesine dahil etmek için kullanılabilir.

  1. Araçlar'ı genişletin veya çözüm gezginine sağ tıklayın.
  2. NuGet Paket Yöneticisini genişletin.
  3. Çözüm için NuGet Paketlerini Yönet üzerine tıklayın veya çözüm gezgininde NuGet Paketlerini Yönet üzerine tıklayın.
Manage NuGet Package

NuGet Paketlerini Yönet

Bundan sonra arama çubuğunda yeni bir pencere görünecektir: IronOCR yazın. Sağ taraftaki proje kutusunu kontrol edin ve Yükle'ye tıklayın.

IronOCR'yi Gözden Geçirin

IronOCR'yi Gözden Geçirin

Bu yöntemi kullanarak, geliştiriciler IronOCR kütüphanesini ve geliştiricinin seçtiği dil paketini yükleyebilirler.

2.2. NuGet web sitesi aracılığıyla doğrudan indirme

IronOCR, aşağıdaki talimatları izleyerek NuGet web sitesinden doğrudan indirilebilir:

  1. "https://www.nuget.org/packages/IronOcr/" bağlantısına gidin.
  2. Sağ taraftaki menüden indirme paketi seçeneğini seçin.
  3. İndirme paketine çift tıklayın. Otomatik olarak yüklenecek.
  4. Daha sonra çözümü yeniden yükleyin ve projede kullanmaya başlayın.

2.3. IronOCR web sayfası üzerinden doğrudan indirme

Geliştiriciler, bu Link'i kullanarak IronOCR kütüphanesini doğrudan web sitesinden indirebilir.

  1. Çözüm penceresinden projeye sağ tıklayın.
  2. Ardından, Referans seçeneğini seçin ve indirilen referansın konumunu tarayın.
  3. Sonra, referans eklemek için Tamam'a tıklayın.

2.4. Visual Studio'da Komut Satırı Kullanmak

  1. Visual Studio'da, Araçlar -> NuGet Paket Yöneticisi -> Paket Yöneticisi Konsolu'na gidin.
  2. Paket yöneticisi konsol sekmesine aşağıdaki satırı girin:
Install-Package IronOcr

Paket şimdi mevcut projeye indirilecek/yüklenecek ve kullanıma hazır.

Package Manager Console

Konsol Uygulaması

Install IronOCR

Konsol Uygulaması

Komutu yazdıktan sonra enter tuşuna basın, bu şekilde yüklenecektir.

2.5. IronOCR Namespace'ini Ekleme

IronOCR'u kullanmak için programa bu kod satırını ekleyin:

using IronOcr;
using IronOcr;
Imports IronOcr
$vbLabelText   $csharpLabel

Şimdi AWS Textract'ı yükleyelim.

3. AWS Textract OCR'nin Kurulumu

Amazon Textract'i ilk kez kullanmadan önce aşağıdaki görevleri tamamlayın:

  1. AWS hizmetlerine kaydolun.
  2. Bir IAM Kullanıcısı oluşturun.

Hesaba başarılı bir şekilde kaydolduktan ve IAM kullanıcı oluşturduktan sonra, C# kullanarak API'ye programatik olarak erişmek için AWS konsolunda erişim anahtarlarını ayarlayabilirsiniz. İhtiyacınız olacak:

AccessKeyId SecretAccessKey

  • RegionEndPoint (Sizin erişim alanınız) - Bu örnek durumda: AFSouth1

3.1. NuGet Paket Yöneticisi Kullanma

NuGet Paket Yöneticisi'nden AWS Textract SDK'sını indirip kurabilirsiniz.

NuGet Paket Yöneticisi

NuGet Paket Yöneticisi

  • Göz At'a tıklayın ve AWS Textract'ı arayın:
AWS Textract

AWS Textract

3.2. AWS OCR Ad Alanlarını Ekleme

AWS Textract kullanmak için aşağıdaki ad alanlarını ekleyin:

using Amazon.Textract;
using Amazon.Textract.Model;
using Amazon.Textract;
using Amazon.Textract.Model;
Imports Amazon.Textract
Imports Amazon.Textract.Model
$vbLabelText   $csharpLabel

4. PDF dosyasını Metne Dönüştürme

Her iki kütüphane de PDF dosyalarından metin çıkarabilir. Kodu teker teker inceleyelim.

4.1. IronOCR Kullanımı

IronOCR, gelişmiş Tesseract kullanarak PDF belge formatlarından metin tanıma ve okuma yapmanızı sağlar. Aşağıdaki basit kod, bilgi çıkarmak için kullanılır:

var Ocr = new IronTesseract();
using (var input = new OcrInput())
{
    input.AddPdf("example.pdf", "password");
    // We can also select specific PDF page numbers to OCR
    var Result = Ocr.Read(input);
    Console.WriteLine(Result.Text);
    Console.WriteLine($"{Result.Pages.Count()} Pages");
    // Read every page of the PDF
}
var Ocr = new IronTesseract();
using (var input = new OcrInput())
{
    input.AddPdf("example.pdf", "password");
    // We can also select specific PDF page numbers to OCR
    var Result = Ocr.Read(input);
    Console.WriteLine(Result.Text);
    Console.WriteLine($"{Result.Pages.Count()} Pages");
    // Read every page of the PDF
}
Dim Ocr = New IronTesseract()
Using input = New OcrInput()
	input.AddPdf("example.pdf", "password")
	' We can also select specific PDF page numbers to OCR
	Dim Result = Ocr.Read(input)
	Console.WriteLine(Result.Text)
	Console.WriteLine($"{Result.Pages.Count()} Pages")
	' Read every page of the PDF
End Using
$vbLabelText   $csharpLabel

Kod basit, temiz ve anlaşılması ile kullanılması çok kolay.

Girdi PDF Dosyası

Örnek PDF

Örnek PDF

Çıktı

IronOCR Çıktısı

IronOCR Çıktısı

4.2. AWS Textract

Amazon Textract, belge metni algılama ve analizini uygulamalarınıza eklemeyi kolaylaştırır. Aşağıdaki kod, PDF okuma için kullanılır ve aynı PDF iletilir:

public static async void ReturnResult()
{
    AmazonTextractClient client = new AmazonTextractClient("your_access_key_id", "your_secret_access_key", Amazon.RegionEndpoint.AFSouth1);
    var request = new StartDocumentTextDetectionRequest();
    request.DocumentLocation = new DocumentLocation
    {
        S3Object = new S3Object
        {
            Bucket = "your_bucket_name",
            Name = "your_bucket_key"
        }
    };
    var id = await client.StartDocumentTextDetectionAsync(request);
    var jobId = id.JobId;
    var response = client.GetDocumentTextDetectionAsync(new GetDocumentTextDetectionRequest{
        JobId = jobId
    });
    response.Wait();
    if (response.Result.JobStatus.Equals("SUCCEEDED"))
    {
        foreach (var block in response.Result.Blocks)
        {
            if (block.BlockType == "WORD" || block.BlockType == "PAGE" || block.BlockType == "LINE")
            {
                Console.WriteLine(block.Text);
            }
        }
    }
}

static void Main(String[] args)
{
    ReturnResult();
}
public static async void ReturnResult()
{
    AmazonTextractClient client = new AmazonTextractClient("your_access_key_id", "your_secret_access_key", Amazon.RegionEndpoint.AFSouth1);
    var request = new StartDocumentTextDetectionRequest();
    request.DocumentLocation = new DocumentLocation
    {
        S3Object = new S3Object
        {
            Bucket = "your_bucket_name",
            Name = "your_bucket_key"
        }
    };
    var id = await client.StartDocumentTextDetectionAsync(request);
    var jobId = id.JobId;
    var response = client.GetDocumentTextDetectionAsync(new GetDocumentTextDetectionRequest{
        JobId = jobId
    });
    response.Wait();
    if (response.Result.JobStatus.Equals("SUCCEEDED"))
    {
        foreach (var block in response.Result.Blocks)
        {
            if (block.BlockType == "WORD" || block.BlockType == "PAGE" || block.BlockType == "LINE")
            {
                Console.WriteLine(block.Text);
            }
        }
    }
}

static void Main(String[] args)
{
    ReturnResult();
}
Public Shared Async Sub ReturnResult()
	Dim client As New AmazonTextractClient("your_access_key_id", "your_secret_access_key", Amazon.RegionEndpoint.AFSouth1)
	Dim request = New StartDocumentTextDetectionRequest()
	request.DocumentLocation = New DocumentLocation With {
		.S3Object = New S3Object With {
			.Bucket = "your_bucket_name",
			.Name = "your_bucket_key"
		}
	}
	Dim id = Await client.StartDocumentTextDetectionAsync(request)
	Dim jobId = id.JobId
	Dim response = client.GetDocumentTextDetectionAsync(New GetDocumentTextDetectionRequest With {.JobId = jobId})
	response.Wait()
	If response.Result.JobStatus.Equals("SUCCEEDED") Then
		For Each block In response.Result.Blocks
			If block.BlockType = "WORD" OrElse block.BlockType = "PAGE" OrElse block.BlockType = "LINE" Then
				Console.WriteLine(block.Text)
			End If
		Next block
	End If
End Sub

Shared Sub Main(ByVal args() As String)
	ReturnResult()
End Sub
$vbLabelText   $csharpLabel

Kod biraz karmaşık, uzun ve nesneleri geçirirken ve geri alırken dikkat gerektiriyor. Öncelikle, 3 parametre ile AmazonTextractClient nesnesi oluşturmamız gerekiyor: AccessKeyId, SecretAccessKey ve Region. Sonra, StartDocumentTextDetectionRequest() yöntemi kullanarak bir istek başlatmamız gerekiyor. İstek nesnesi daha sonra kova adı ve anahtarı kullanarak DocumentLocation ayarlar. Bu istek daha sonra StartDocumentTextDetectionAsync() yöntemine iletilir. Bu yöntem bir async yöntemi olduğu için await anahtar kelimesini kullanmalı ve ReturnResult fonksiyonunu async yapmalıyız. Başarı durumunda, sonuç döndürülür ve jobId kaydedilir. jobId, GetDocumentTextDetectionAsync() metoduna iletilir ve SUCCEEDED yanıtını bekler. Her bir bloğu döngüden geçmek için foreach döngüsü kullanılır ve eğer 'WORD', 'PAGE' veya 'LINE' olup olmadığını kontrol eder, ardından metin tanımayı yazdırır. Son olarak, belge işleme için bu yöntemi Main metodunda çağırın.

Çıktı

Çıktı, IronOCR'ye oldukça benzer.

AWS Textract Çıktısı

AWS Textract Çıktısı

5. Görsellerden Metne

Görüntülerden veri okumak zordur çünkü bilgi çıkarırken görüntü kalitesi önemli bir rol oynar. Her iki kütüphane de metin çıkarma olanağı sağlar. Burada png dosyalarını kullanacağız.

5.1. IronOCR Kullanımı

Kod, öncekine neredeyse benzer. Burada, AddPDF yöntemi AddImage yöntemiyle değiştirilir.

var Ocr = new IronTesseract();
using (var Input = new OcrInput())
{
    Input.AddImage("test-files/redacted-employmentapp.png");
    //... you can add any number of images
    var Result = Ocr.Read(Input);
    Console.WriteLine(Result.Text);
}
var Ocr = new IronTesseract();
using (var Input = new OcrInput())
{
    Input.AddImage("test-files/redacted-employmentapp.png");
    //... you can add any number of images
    var Result = Ocr.Read(Input);
    Console.WriteLine(Result.Text);
}
Dim Ocr = New IronTesseract()
Using Input = New OcrInput()
	Input.AddImage("test-files/redacted-employmentapp.png")
	'... you can add any number of images
	Dim Result = Ocr.Read(Input)
	Console.WriteLine(Result.Text)
End Using
$vbLabelText   $csharpLabel

Giriş Görüntüsü

Gizlenmiş Çalışan Verileri

Gizlenmiş Çalışan Verileri

Çıktı

Çıktı temizdir ve herhangi bir teknik ayrıntıya gerek kalmadan, sadece birkaç satır kod ile orijinal görüntüyle eşleşir ve mükemmel bir çıktı sağlar.

Görüntü Çıktısı

Görüntü Çıktısı

5.2. AWS Textract Kullanılarak

Aşağıdaki kod, resimlerden metin tespit etmeye yardımcı olur:

public static async void ReturnResult()
{
    AmazonTextractClient client = new AmazonTextractClient("your_access_key_id", "your_secret_access_key", Amazon.RegionEndpoint.AFSouth1);
    var request = new DetectDocumentTextRequest();
    request.Document = new Document
    {
        Bytes = new MemoryStream(File.ReadAllBytes(@"test-files/redacted-employmentapp.png"))
    };    
    var result = await client.DetectDocumentTextAsync(request);
    foreach (var block in result.Blocks)
    {
        if (block.BlockType == "WORD")
        {
            Console.WriteLine(block.Text);
        }
    }
}

static void Main(String[] args)
{
    ReturnResult();
}
public static async void ReturnResult()
{
    AmazonTextractClient client = new AmazonTextractClient("your_access_key_id", "your_secret_access_key", Amazon.RegionEndpoint.AFSouth1);
    var request = new DetectDocumentTextRequest();
    request.Document = new Document
    {
        Bytes = new MemoryStream(File.ReadAllBytes(@"test-files/redacted-employmentapp.png"))
    };    
    var result = await client.DetectDocumentTextAsync(request);
    foreach (var block in result.Blocks)
    {
        if (block.BlockType == "WORD")
        {
            Console.WriteLine(block.Text);
        }
    }
}

static void Main(String[] args)
{
    ReturnResult();
}
Public Shared Async Sub ReturnResult()
	Dim client As New AmazonTextractClient("your_access_key_id", "your_secret_access_key", Amazon.RegionEndpoint.AFSouth1)
	Dim request = New DetectDocumentTextRequest()
	request.Document = New Document With {.Bytes = New MemoryStream(File.ReadAllBytes("test-files/redacted-employmentapp.png"))}
	Dim result = Await client.DetectDocumentTextAsync(request)
	For Each block In result.Blocks
		If block.BlockType = "WORD" Then
			Console.WriteLine(block.Text)
		End If
	Next block
End Sub

Shared Sub Main(ByVal args() As String)
	ReturnResult()
End Sub
$vbLabelText   $csharpLabel

Yine, kod öncekiyle neredeyse benzer. Burada, DetectDocumentTextRequest() yöntemi kullanarak bir istek başlatmamız gerekiyor. İstek nesnesi daha sonra tüm baytları okuyarak belgeyi ayarlar. Bu istek daha sonra DetectDocumentTextAsync() yöntemine iletilir. Bu yöntem bir async yöntemi olduğu için await anahtar kelimesini kullanmalı ve ReturnResult fonksiyonunu async yapmalıyız. Başarı durumunda, sonuç bloklar halinde döndürülür. Her bir bloğu döngüden geçmek için foreach döngüsü kullanılır ve eğer 'WORD' olup olmadığını kontrol eder, ardından metin tanımayı yazdırır. Son olarak, belge işleme için bu yöntemi Main metodunda çağırın.

Çıktı IronOCR'ye benzer, ancak öncelikle dosyanın AWS bucket'a yüklenmesi gerekiyor.

6. Barkod ve QR kodu Metne

IronOCR'un benzersiz bir özelliği, metin tararken belgelerden barkodları ve QR kodlarını okuyabilmesidir. OcrResult.OcrBarcode sınıfının örnekleri, geliştiriciye her taranan barkod hakkında detaylı bilgi verir. AWS Textract bu işlevi sağlamamaktadır.

IronOCR için kod aşağıda verilmiştir:

var Ocr = new IronTesseract();
Ocr.Configuration.ReadBarCodes = true;
using (var input = new OcrInput())
{
    input.AddImage("test-files/Barcode.png");
    var Result = Ocr.Read(input);
    foreach (var Barcode in Result.Barcodes)
    {
        Console.WriteLine(Barcode.Value);
        // type and location properties also exposed
    }
}
var Ocr = new IronTesseract();
Ocr.Configuration.ReadBarCodes = true;
using (var input = new OcrInput())
{
    input.AddImage("test-files/Barcode.png");
    var Result = Ocr.Read(input);
    foreach (var Barcode in Result.Barcodes)
    {
        Console.WriteLine(Barcode.Value);
        // type and location properties also exposed
    }
}
Dim Ocr = New IronTesseract()
Ocr.Configuration.ReadBarCodes = True
Using input = New OcrInput()
	input.AddImage("test-files/Barcode.png")
	Dim Result = Ocr.Read(input)
	For Each Barcode In Result.Barcodes
		Console.WriteLine(Barcode.Value)
		' type and location properties also exposed
	Next Barcode
End Using
$vbLabelText   $csharpLabel

Kod kendini açıklayıcı ve anlaşılması kolay.

7. Lisanslama

IronOCR, geliştirici lisansını ücretsiz olarak sağlayan bir kütüphanedir. Ayrıca kendine özgü bir fiyatlandırma yapısına sahiptir; Lite paket, hiçbir gizli ücret olmadan $999 ile başlar. SaaS ve OEM ürünlerinin yeniden dağıtımı da mümkündür. Tüm lisanslar, 30 günlük para iade garantisi, bir yıl yazılım desteği ve güncellemeleri, geliştirme/test/üretim geçerliliği ve süresiz lisans (tek seferlik satın alma) ile birlikte gelir. IronOCR'un tüm fiyat yapısını ve lisanslama detaylarını görmek için buraya tıklayın.

IronOCR Fiyatlandırma Planı

IronOCR Fiyatlandırma Planı

SaaS ve OEM ürünlerinin yeniden dağıtımı için telif ücretsiz hizmeti sadece bir $1,599 defalık satın alma ile alabilirsiniz.

SAAS Hizmeti

SAAS Hizmeti

AWS Textract API geliştiricilere AWS Free Tier hizmeti sunar. Amazon Textract ile ücretsiz başlayabilirsiniz. Ücretsiz Katman üç ay sürer ve fiyatlandırma aşağıda gösterilmiştir.

Fiyat Listesi

Fiyat Listesi

Fiyat Listesi

Bu linkten fiyat detaylarına göz atabilirsiniz. Ayrıca, fiyat hesaplayıcısını kullanarak fiyatları ihtiyaçlarınıza göre ayarlayabilirsiniz.

8. Sonuç

IronOCR, C# geliştiricilerine, bildiğimiz en gelişmiş Tesseract API'sini, herhangi bir platformda sunar. IronOCR, Windows, Linux, Mac, Azure, AWS, Lambda üzerinde dağıtılabilir ve .NET Framework projelerinin yanı sıra .NET Standard ve .NET Core destekler. OCR taramalarında barkodları da okuyabiliriz ve hatta OCR çıktımızı HTML ve aranabilir PDF'ler olarak da dışa aktarabiliriz.

Amazon Textract, belge metni algılama ve analizini uygulamalarınıza eklemeyi kolaylaştırır. Amazon Textract, günlük olarak milyarlarca görüntü ve videoyu analiz etmek için Amazon'un bilgisayarlı görüş bilimcileri tarafından geliştirilen, kanıtlanmış, yüksek ölçeklenebilir, derin öğrenme teknolojisine dayanır. Bunu kullanmak için herhangi bir makine öğrenimi uzmanlığına ihtiyacınız yok. Amazon Textract, resim dosyalarını ve PDF dosyalarını analiz edebilen, basit ve kullanımı kolay API'ler içerir. Amazon Textract, yeni verilerden sürekli olarak öğrenir ve Amazon, hizmete sürekli olarak yeni özellikler ekler.

IronOCR lisansları geliştirici bazlıdır, bu da ürünü kullanacak geliştirici sayısına göre lisans satın almanız gerektiği anlamına gelir. AWS Textract lisansları, bilgileri çıkarmak ve verileri analiz etmek için belgenin sayfa sayısına dayanmaktadır. Lisanslar aylık bazda sunulmaktadır ve fiyatlar, IronOCR lisansına kıyasla çok sayıda sayfa için çok yüksek hale gelmektedir. Ayrıca, IronOCR lisansı tek seferlik bir satın alımdır ve ömür boyu kullanılabilir ve OEM ve SaaS dağıtımını destekler.

Genel karşılaştırmada, IronOCR ve AWS OCR'ın her ikisi de bir belge veya görüntüden metin algılamak için makine öğrenimi yeteneklerine sahiptir. IronOCR, hızı ve zaman tasarrufu açısından AWS OCR'a karşı hafif bir avantaja sahiptir. Kod basittir ve belgelerden metin algılarken doğrudan bir yaklaşıma sahiptir. Görev birkaç yöntemle tamamlanır. Öte yandan, AWS Textract aynı görevi gerçekleştirmek için birçok yöntem kullanır. Bu, sunucu yanıtını artırır ve bazen zaman alıcı olabilir. IronOCR'ye kusursuz olmayan bir belge bile girdiğimizde, belgenin kötü biçimlendirilmiş, eğilmiş ve dijital parazit içermesine rağmen içeriğini yaklaşık %99'luk istatistiksel bir doğrulukla doğru bir şekilde okuyabildiğini görebiliyoruz. IronOCR, ek bir performans ayarlaması yapmaya veya giriş görüntülerini ağır bir şekilde değiştirmeye gerek olmadan, kutusundan çıktığı gibi çalışır. Hız göz alıcı: IronOCR.2020+, önceki sürümlere göre 10 kat daha hızlı ve %250'den fazla daha az hata yapar.

Ayrıca, Iron Software şu anda beş araçlık bir paketi sadece iki fiyatına sunuyor. Iron Suite içinde yer alan araçlar şunlardır:

  • IronBarcode IronXL
  • IronOCR
  • IronPDF IronWebScraper

Iron Suite keşfetmek için lütfen bu bağlantıyı ziyaret edin.

[[i: (AWS Textract ve Tesseract, sahiplerinin tescilli markalarıdır. Bu site, Amazon Web Services veya Google tarafından onaylanmayan, bağlantılı olmayan veya sponsorlanmayan bir sitedir. Tüm ürün adları, logolar ve markalar kendi sahiplerine aittir. Karşılaştırmalar, yalnızca bilgilendirme amaçlıdır ve yazı sırasında halka açık bilgilerle alakalı olarak yansıtılmaktadır.)]]

Sıkça Sorulan Sorular

Optik Karakter Tanıma (OCR) nedir?

Optik Karakter Tanıma (OCR), taranmış kağıt belgeler, PDF'ler veya dijital kamera ile çekilmiş görüntüler gibi farklı türdeki belgeleri düzenlenebilir ve aranabilir verilere dönüştüren bir teknolojidir. IronOCR, bu süreci gelişmiş algoritmalar kullanarak geliştiren güçlü bir C# .NET kütüphanesidir.

C# kullanarak metin görüntülerini makine tarafından okunabilir metne nasıl dönüştürebilirim?

C# .NET kütüphanesi olan IronOCR'yi, metin görüntülerini makine tarafından okunabilir metne dönüştürmek için kullanabilirsiniz. Görüntüleri gelişmiş OCR algoritmaları ile işler ve tanınan metni programatik olarak kolayca düzenlenebilen formatlarda çıktılar.

IronOCR, kusurlu taranmış görüntüleri nasıl işliyor?

IronOCR, kusurlu taranmış görüntüleri etkili bir şekilde yönetip işlemek için tasarlanmıştır. Eğiklik düzeltme, metin kontrastını artırma ve görüntü kalitesini optimize etme gibi ön işleme yetenekleri OCR doğruluğunu artırmak için içerir.

IronOCR'yi çoklu iş parçacıklı işlem için kullanabilir miyim?

Evet, IronOCR çoklu iş parçacığı desteği sunar, bu da aynı anda birden fazla belgeyi işleyerek belge ağırlıklı uygulamalarda performans ve verimliliği önemli ölçüde artırır.

IronOCR, OCR görevleri için hangi dilleri destekler?

IronOCR, 125'ten fazla dili destekler ve bu da onu, birden fazla dilde belgelerin işlenmesi ve metne dönüştürülmesi gereken küresel uygulamaları için çok yönlü bir araç yapar.

IronOCR, Visual Studio projesine nasıl kurulur?

IronOCR, Visual Studio projesine NuGet Paket Yöneticisi aracılığıyla kurulabilir. NuGet konsolunda 'IronOCR' arayarak kurabilir ve böylece .NET uygulamalarınıza OCR fonksiyonunu entegre edebilirsiniz.

IronOCR'nin fiyatlandırma modeli nedir?

IronOCR, süresiz lisanslar dahil olan bir defalık lisanslama modeli sunar ve bu lisanslar 30 günlük para iade garantisi ile birlikte gelir, geliştiriciler için esneklik ve güvence sağlar.

AWS Textract, teknoloji açısından IronOCR'den nasıl farklıdır?

AWS Textract, belge içeriğinin ayrıntılı analizini sağlayan metin ve veri çıkarmak için makine öğrenimi ve derin öğrenme teknolojilerini kullanır. Buna karşılık, IronOCR, kapsamlı dil desteği sunan sağlam bir OCR çözümü sunarak .NET projeleri içinde kullanım ve entegrasyon kolaylığına odaklanır.

IronOCR, barkod ve QR kodlarını okuyabilir ve işleyebilir mi?

Evet, IronOCR, barkod ve QR kodlarını okuyabilir ve işleyebilir. Her bir kod hakkında ayrıntılı bilgi çıkarırken aynı anda metin taraması yaparak belge işleme için kapsamlı bir araç haline getirir.

IronOCR hangi platformlar ve ortamlar tarafından desteklenir?

IronOCR, Windows, Linux, Mac, Azure, AWS ve Lambda dahil olmak üzere geniş bir ortam yelpazesi ile uyumludur. .NET Framework, .NET Standard ve .NET Core projelerini destekleyerek farklı geliştirme ekosistemlerinde esneklik sağlar.

Curtis Chau
Teknik Yazar

Curtis Chau, Bilgisayar Bilimleri alanında Lisans Derecesine (Carleton Üniversitesi) sahip ve Node.js, TypeScript, JavaScript ve React konularında uzmanlaşmış ön uç geliştirmeyle ilgileniyor. Sezgisel ve estetik açıdan hoş kullanıcı arayüzleri oluşturma tutkunu, Curtis modern çerçevelerle çalışmayı ve iyi yapı...

Daha Fazla Oku

Iron Destek Ekibi

Haftada 5 gün, 24 saat çevrimiçiyiz.
Sohbet
E-posta
Beni Ara