IronOCR ve AWS Textract OCR Arasında Karşılaştırma
OCR Nedir?
Metin içeren bir görüntüyü makine tarafından okunabilir bir metin formatına dönüştürmek için kullanılan prosedür, Optik Karakter Tanıma (OCR) olarak bilinir. Örneğin, bir form, fatura veya makbuzu taradığınızda, bilgisayarınız taramayı bir görüntü dosyası olarak kaydeder. Görüntü dosyasındaki veriler bir metin editörü kullanılarak düzenlenemez, aranamaz veya sayılmaz. Ancak, görüntü dosyasını metin belgesine dönüştürmek ve içeriğini metin verisi olarak saklamak için OCR çözümleri kullanabilirsiniz.
Bu modern çağda, çoğu iş akışı, bilgiyi baskıdan almaktadır. Kağıt formlar, faturalar, taranmış yasal belgeler, tablo çekim ve basılı metin veya sözleşmeler gibi farklı belgeler iş süreçlerinin bir parçasıdır. Ayrıca, böyle dokümantasyon içeriğini dijitalleştirmek, metni içinde gizli olan görüntüler oluşturur. Görüntülerdeki metin, kelime işleme araçları tarafından metin belgeleri gibi işlenemez. OCR teknolojisi, metin görüntülerini diğer iş yazılımları tarafından analiz edilebilecek metin verisine dönüştürerek sorunu çözer.
OCR Nasıl Çalışır?
OCR motoru, aşağıdaki adımları kullanarak çalışır:
Görüntü Elde Etme
Bu süreçte bir tarayıcı belgeleri okur ve onları ikili verilere dönüştürür. OCR yazılımı taranan görüntüyü tanımlar ve ışık alanlarını arka plan olarak, karanlık alanları ise metin olarak sınıflandırır.
Ön İşleme
OCR yazılımı önce görüntüyü temizler ve okuma için verilerini hazırlamak için hataları giderir.
Metin Tanıma
Metin tanıma için iki ana OCR algoritması türü, desen eşleştirme ve özellik ekstraksiyonudur.
Desen Eşleştirme
Desen eşleştirme sürecinde bir karakter resmi, veya glif, izole edilir ve önceden kaydedilmiş bir glifle karşılaştırılır.
Özellik Çıkarımı
Özellik çıkarımı süreci sırasında glifler, çizgiler, kapalı halkalar, çizgi yönü ve çizgi kavşakları gibi özelliklere ayrılır.
Son İşleme
Teknoloji, analizden sonra alınan metin verisini dijital bir dosya haline dönüştürür. Bazı OCR sistemleri, taranmış belgenin hem öncesini hem de sonrasını içeren açıklamalı PDF belgeleri oluşturabilir.
Bu makale, OCR için en yaygın uygulama ve belge kütüphanelerinden ikisi arasındaki karşılaştırmayı tartışacak:
- IronOCR
- AWS OCR Textract
IronOCR Kütüphanesi
IronOCR, tarama, arama, resim ve PDF okuma hizmetleri sunan bir C# .NET kütüphanesidir. 125'den fazla global dil paketleri ile birlikte gelmektedir. Çıktı, metin, yapılandırılmış veri ya da aranabilir PDF olarak elde edilir. .NET versiyonlarını destekler: 6, 5, Core, Standard ve Framework.
IronOCR, kusurlu bir şekilde taranmış görüntülerden ve belgelerden veriyi otomatik olarak tespit etme ve çıkarma yeteneği ile benzersizdir. 'IronTesseract' Sınıfı, en basit API'ye sahiptir. Herhangi bir platformda, en hızlı, en doğru ve yerel DLL ve API ile bilinen en gelişmiş Tesseract yapısını sunar.
IronOCR ayrıca tüm görüntü formatlarından barkod ve QR kodlarını da tarayabilir ve en son Tesseract 5 motorunu kullanarak metin okumaları ve PDF taramaları gerçekleştirebilir.
Özellikler
Sadece .NET uygulamaları için yapılmıştır. 125 farklı dili destekleyebilir. IronOCR tarafından Arapça, Çince, İngilizce, Fince, Fransızca, Almanca, Japonca ve birçok diğer dil desteklenir.
- Bir görüntünün eğimli konumunu düzeltebilir ve kesin çıktılar için görüntüden parazitleri kaldırabilir. Düşük çözünürlüklü ve düşük DPI'lı görüntülerde olağanüstü performans gösterir. Birden fazla türde QR kodu ve barkodu okuyabilir.
- Gif ve Tiff formatlarını da destekler.
- Birçok iş parçacığını aynı anda çalıştırmasına olanak tanır. Bu, diğer OCR kütüphanelerinde bulunmayan olağanüstü bir özelliktir. Süreçleri daha pürüzsüz hale getirir. Kolayca PDF dosyaları üzerinde OCR gerçekleştirebilir ve OCR kullanarak aranabilir PDF belgeleri dışa aktarabilir.
Şimdi, AWS OCR'a bir göz atalım.
AWS OCR Textract
Amazon'un AWS Textract, taranmış belgelerden metin ve veri otomatik olarak çıkaran bir makine öğrenimi (ML) hizmetidir. Derin öğrenme teknolojisini kullanarak formlar ve tablolardan veri tanımlama, anlama ve çıkarma işlemleri yapmak için basit optik karakter tanıma (OCR) ötesine geçer.
AWS OCR Textract, herhangi bir belge türünü okumak ve işlemek için makine öğrenimini kullanır, manuel çaba gerektirmeden metni, tablolara ait verileri ve diğer verileri doğru bir şekilde çıkarır. Verileri çıkarmak saatler veya günler almak yerine, Textract bunu hızlı bir şekilde yapabilir. Ayrıca, modellerinizin denetlenmesi ve hassas verilerin kontrolü için Amazon Artırılmış Yapay Zeka (AI) ile insan değerlendirmeleri ekleyebilirsiniz.
Özellikler
- Finansal raporlar, tıbbi kayıtlar, tablolar ve vergi formları dahil olmak üzere çeşitli belgelerde metin tespit edin.
- Belgelerden metin, form ve tablo verilerini, yapılandırılmış veri kullanarak belge analizi API'si ile çıkarın.
- Analyze Document API içindeki Queries özelliğini kullanarak belgelerden bilgi belirleyin ve çıkarın. Faturaları ve makbuzları Analyze Expense API ile işleyin.
- ABD tarafından verilen sürücü belgeleri ve pasaportlar gibi kimlik belgelerini işleyin government, Analyze ID API kullanarak.
- Karar alma süreçlerini hızlandırabilecek ölçeklenebilir belge analizi.
Makalenin geri kalanı şu şekildedir:
- Visual Studio Projesi Oluşturma
- IronOCR'un Kurulumu
- AWS OCR Textract Kurulumu
- PDF'den Metne
- Görüntüden Metne
- Barkod ve QR'den Metne
- Lisanslama
- Sonuç
1. Visual Studio Projesi Oluşturma
Bu öğretici Visual Studio 2022 sürümünü kullanacak, bu yüzden yüklü olduğunu varsayıyorum.
- Visual Studio 2022'yi açın.
- Yeni bir .NET Core projesi oluşturun ve ardından Console App'i seçin.
Konsol Uygulaması
- Projeye bir ad verin. Örneğin, TextReader.
-
.NET framework'in en son ve en kararlı sürümü 6.0. Bunu kullanacağız.

- Oluştur düğmesine tıklayın ve proje oluşturulacaktır.
Sonraki adımda, kullanacağımız kütüphaneleri teker teker yükleyeceğiz.
2. IronOCR'nin Kurulumu
IronOCR kütüphanesi dört şekilde indirilebilir ve yüklenebilir. Bunlar aşağıdaki gibi:
- Visual Studio NuGet Paket Yöneticisi kullanarak.
- NuGet web sitesi üzerinden doğrudan indirme.
- IronOCR web sayfası üzerinden doğrudan indirme.
- Visual Studio'da Komut Satırını Kullanma.
2.1. Visual Studio NuGet Yöneticisini Kullanma
Visual Studio NuGet Paket Yöneticisi, IronOCR'u bir C# projesine dahil etmek için kullanılabilir.
- Araçlar'ı genişletin veya çözüm gezginine sağ tıklayın.
- NuGet Paket Yöneticisini genişletin.
- Çözüm için NuGet Paketlerini Yönet üzerine tıklayın veya çözüm gezgininde NuGet Paketlerini Yönet üzerine tıklayın.
NuGet Paketlerini Yönet
Bundan sonra arama çubuğunda yeni bir pencere görünecektir: IronOCR yazın. Sağ taraftaki proje kutusunu kontrol edin ve Yükle'ye tıklayın.
IronOCR'yi Gözden Geçirin
Bu yöntemi kullanarak, geliştiriciler IronOCR kütüphanesini ve geliştiricinin seçtiği dil paketini yükleyebilirler.
2.2. NuGet web sitesi aracılığıyla doğrudan indirme
IronOCR, aşağıdaki talimatları izleyerek NuGet web sitesinden doğrudan indirilebilir:
- "https://www.nuget.org/packages/IronOcr/" bağlantısına gidin.
- Sağ taraftaki menüden indirme paketi seçeneğini seçin.
- İndirme paketine çift tıklayın. Otomatik olarak yüklenecek.
- Daha sonra çözümü yeniden yükleyin ve projede kullanmaya başlayın.
2.3. IronOCR web sayfası üzerinden doğrudan indirme
Geliştiriciler, bu Link'i kullanarak IronOCR kütüphanesini doğrudan web sitesinden indirebilir.
- Çözüm penceresinden projeye sağ tıklayın.
- Ardından, Referans seçeneğini seçin ve indirilen referansın konumunu tarayın.
- Sonra, referans eklemek için Tamam'a tıklayın.
2.4. Visual Studio'da Komut Satırı Kullanmak
- Visual Studio'da, Araçlar -> NuGet Paket Yöneticisi -> Paket Yöneticisi Konsolu'na gidin.
- Paket yöneticisi konsol sekmesine aşağıdaki satırı girin:
Install-Package IronOcr
Paket şimdi mevcut projeye indirilecek/yüklenecek ve kullanıma hazır.
Konsol Uygulaması
Konsol Uygulaması
Komutu yazdıktan sonra enter tuşuna basın, bu şekilde yüklenecektir.
2.5. IronOCR Namespace'ini Ekleme
IronOCR'u kullanmak için programa bu kod satırını ekleyin:
using IronOcr;
using IronOcr;
Imports IronOcr
Şimdi AWS Textract'ı yükleyelim.
3. AWS Textract OCR'nin Kurulumu
Amazon Textract'i ilk kez kullanmadan önce aşağıdaki görevleri tamamlayın:
- AWS hizmetlerine kaydolun.
- Bir IAM Kullanıcısı oluşturun.
Hesaba başarılı bir şekilde kaydolduktan ve IAM kullanıcı oluşturduktan sonra, C# kullanarak API'ye programatik olarak erişmek için AWS konsolunda erişim anahtarlarını ayarlayabilirsiniz. İhtiyacınız olacak:
AccessKeyId SecretAccessKey
- RegionEndPoint (Sizin erişim alanınız) - Bu örnek durumda: AFSouth1
3.1. NuGet Paket Yöneticisi Kullanma
NuGet Paket Yöneticisi'nden AWS Textract SDK'sını indirip kurabilirsiniz.
NuGet Paket Yöneticisi
- Göz At'a tıklayın ve AWS Textract'ı arayın:
AWS Textract
3.2. AWS OCR Ad Alanlarını Ekleme
AWS Textract kullanmak için aşağıdaki ad alanlarını ekleyin:
using Amazon.Textract;
using Amazon.Textract.Model;
using Amazon.Textract;
using Amazon.Textract.Model;
Imports Amazon.Textract
Imports Amazon.Textract.Model
4. PDF dosyasını Metne Dönüştürme
Her iki kütüphane de PDF dosyalarından metin çıkarabilir. Kodu teker teker inceleyelim.
4.1. IronOCR Kullanımı
IronOCR, gelişmiş Tesseract kullanarak PDF belge formatlarından metin tanıma ve okuma yapmanızı sağlar. Aşağıdaki basit kod, bilgi çıkarmak için kullanılır:
var Ocr = new IronTesseract();
using (var input = new OcrInput())
{
input.AddPdf("example.pdf", "password");
// We can also select specific PDF page numbers to OCR
var Result = Ocr.Read(input);
Console.WriteLine(Result.Text);
Console.WriteLine($"{Result.Pages.Count()} Pages");
// Read every page of the PDF
}
var Ocr = new IronTesseract();
using (var input = new OcrInput())
{
input.AddPdf("example.pdf", "password");
// We can also select specific PDF page numbers to OCR
var Result = Ocr.Read(input);
Console.WriteLine(Result.Text);
Console.WriteLine($"{Result.Pages.Count()} Pages");
// Read every page of the PDF
}
Dim Ocr = New IronTesseract()
Using input = New OcrInput()
input.AddPdf("example.pdf", "password")
' We can also select specific PDF page numbers to OCR
Dim Result = Ocr.Read(input)
Console.WriteLine(Result.Text)
Console.WriteLine($"{Result.Pages.Count()} Pages")
' Read every page of the PDF
End Using
Kod basit, temiz ve anlaşılması ile kullanılması çok kolay.
Girdi PDF Dosyası
Örnek PDF
Çıktı
IronOCR Çıktısı
4.2. AWS Textract
Amazon Textract, belge metni algılama ve analizini uygulamalarınıza eklemeyi kolaylaştırır. Aşağıdaki kod, PDF okuma için kullanılır ve aynı PDF iletilir:
public static async void ReturnResult()
{
AmazonTextractClient client = new AmazonTextractClient("your_access_key_id", "your_secret_access_key", Amazon.RegionEndpoint.AFSouth1);
var request = new StartDocumentTextDetectionRequest();
request.DocumentLocation = new DocumentLocation
{
S3Object = new S3Object
{
Bucket = "your_bucket_name",
Name = "your_bucket_key"
}
};
var id = await client.StartDocumentTextDetectionAsync(request);
var jobId = id.JobId;
var response = client.GetDocumentTextDetectionAsync(new GetDocumentTextDetectionRequest{
JobId = jobId
});
response.Wait();
if (response.Result.JobStatus.Equals("SUCCEEDED"))
{
foreach (var block in response.Result.Blocks)
{
if (block.BlockType == "WORD" || block.BlockType == "PAGE" || block.BlockType == "LINE")
{
Console.WriteLine(block.Text);
}
}
}
}
static void Main(String[] args)
{
ReturnResult();
}
public static async void ReturnResult()
{
AmazonTextractClient client = new AmazonTextractClient("your_access_key_id", "your_secret_access_key", Amazon.RegionEndpoint.AFSouth1);
var request = new StartDocumentTextDetectionRequest();
request.DocumentLocation = new DocumentLocation
{
S3Object = new S3Object
{
Bucket = "your_bucket_name",
Name = "your_bucket_key"
}
};
var id = await client.StartDocumentTextDetectionAsync(request);
var jobId = id.JobId;
var response = client.GetDocumentTextDetectionAsync(new GetDocumentTextDetectionRequest{
JobId = jobId
});
response.Wait();
if (response.Result.JobStatus.Equals("SUCCEEDED"))
{
foreach (var block in response.Result.Blocks)
{
if (block.BlockType == "WORD" || block.BlockType == "PAGE" || block.BlockType == "LINE")
{
Console.WriteLine(block.Text);
}
}
}
}
static void Main(String[] args)
{
ReturnResult();
}
Public Shared Async Sub ReturnResult()
Dim client As New AmazonTextractClient("your_access_key_id", "your_secret_access_key", Amazon.RegionEndpoint.AFSouth1)
Dim request = New StartDocumentTextDetectionRequest()
request.DocumentLocation = New DocumentLocation With {
.S3Object = New S3Object With {
.Bucket = "your_bucket_name",
.Name = "your_bucket_key"
}
}
Dim id = Await client.StartDocumentTextDetectionAsync(request)
Dim jobId = id.JobId
Dim response = client.GetDocumentTextDetectionAsync(New GetDocumentTextDetectionRequest With {.JobId = jobId})
response.Wait()
If response.Result.JobStatus.Equals("SUCCEEDED") Then
For Each block In response.Result.Blocks
If block.BlockType = "WORD" OrElse block.BlockType = "PAGE" OrElse block.BlockType = "LINE" Then
Console.WriteLine(block.Text)
End If
Next block
End If
End Sub
Shared Sub Main(ByVal args() As String)
ReturnResult()
End Sub
Kod biraz karmaşık, uzun ve nesneleri geçirirken ve geri alırken dikkat gerektiriyor. Öncelikle, 3 parametre ile AmazonTextractClient nesnesi oluşturmamız gerekiyor: AccessKeyId, SecretAccessKey ve Region. Sonra, StartDocumentTextDetectionRequest() yöntemi kullanarak bir istek başlatmamız gerekiyor. İstek nesnesi daha sonra kova adı ve anahtarı kullanarak DocumentLocation ayarlar. Bu istek daha sonra StartDocumentTextDetectionAsync() yöntemine iletilir. Bu yöntem bir async yöntemi olduğu için await anahtar kelimesini kullanmalı ve ReturnResult fonksiyonunu async yapmalıyız. Başarı durumunda, sonuç döndürülür ve jobId kaydedilir. jobId, GetDocumentTextDetectionAsync() metoduna iletilir ve SUCCEEDED yanıtını bekler. Her bir bloğu döngüden geçmek için foreach döngüsü kullanılır ve eğer 'WORD', 'PAGE' veya 'LINE' olup olmadığını kontrol eder, ardından metin tanımayı yazdırır. Son olarak, belge işleme için bu yöntemi Main metodunda çağırın.
Çıktı
Çıktı, IronOCR'ye oldukça benzer.
AWS Textract Çıktısı
5. Görsellerden Metne
Görüntülerden veri okumak zordur çünkü bilgi çıkarırken görüntü kalitesi önemli bir rol oynar. Her iki kütüphane de metin çıkarma olanağı sağlar. Burada png dosyalarını kullanacağız.
5.1. IronOCR Kullanımı
Kod, öncekine neredeyse benzer. Burada, AddPDF yöntemi AddImage yöntemiyle değiştirilir.
var Ocr = new IronTesseract();
using (var Input = new OcrInput())
{
Input.AddImage("test-files/redacted-employmentapp.png");
//... you can add any number of images
var Result = Ocr.Read(Input);
Console.WriteLine(Result.Text);
}
var Ocr = new IronTesseract();
using (var Input = new OcrInput())
{
Input.AddImage("test-files/redacted-employmentapp.png");
//... you can add any number of images
var Result = Ocr.Read(Input);
Console.WriteLine(Result.Text);
}
Dim Ocr = New IronTesseract()
Using Input = New OcrInput()
Input.AddImage("test-files/redacted-employmentapp.png")
'... you can add any number of images
Dim Result = Ocr.Read(Input)
Console.WriteLine(Result.Text)
End Using
Giriş Görüntüsü
Gizlenmiş Çalışan Verileri
Çıktı
Çıktı temizdir ve herhangi bir teknik ayrıntıya gerek kalmadan, sadece birkaç satır kod ile orijinal görüntüyle eşleşir ve mükemmel bir çıktı sağlar.
Görüntü Çıktısı
5.2. AWS Textract Kullanılarak
Aşağıdaki kod, resimlerden metin tespit etmeye yardımcı olur:
public static async void ReturnResult()
{
AmazonTextractClient client = new AmazonTextractClient("your_access_key_id", "your_secret_access_key", Amazon.RegionEndpoint.AFSouth1);
var request = new DetectDocumentTextRequest();
request.Document = new Document
{
Bytes = new MemoryStream(File.ReadAllBytes(@"test-files/redacted-employmentapp.png"))
};
var result = await client.DetectDocumentTextAsync(request);
foreach (var block in result.Blocks)
{
if (block.BlockType == "WORD")
{
Console.WriteLine(block.Text);
}
}
}
static void Main(String[] args)
{
ReturnResult();
}
public static async void ReturnResult()
{
AmazonTextractClient client = new AmazonTextractClient("your_access_key_id", "your_secret_access_key", Amazon.RegionEndpoint.AFSouth1);
var request = new DetectDocumentTextRequest();
request.Document = new Document
{
Bytes = new MemoryStream(File.ReadAllBytes(@"test-files/redacted-employmentapp.png"))
};
var result = await client.DetectDocumentTextAsync(request);
foreach (var block in result.Blocks)
{
if (block.BlockType == "WORD")
{
Console.WriteLine(block.Text);
}
}
}
static void Main(String[] args)
{
ReturnResult();
}
Public Shared Async Sub ReturnResult()
Dim client As New AmazonTextractClient("your_access_key_id", "your_secret_access_key", Amazon.RegionEndpoint.AFSouth1)
Dim request = New DetectDocumentTextRequest()
request.Document = New Document With {.Bytes = New MemoryStream(File.ReadAllBytes("test-files/redacted-employmentapp.png"))}
Dim result = Await client.DetectDocumentTextAsync(request)
For Each block In result.Blocks
If block.BlockType = "WORD" Then
Console.WriteLine(block.Text)
End If
Next block
End Sub
Shared Sub Main(ByVal args() As String)
ReturnResult()
End Sub
Yine, kod öncekiyle neredeyse benzer. Burada, DetectDocumentTextRequest() yöntemi kullanarak bir istek başlatmamız gerekiyor. İstek nesnesi daha sonra tüm baytları okuyarak belgeyi ayarlar. Bu istek daha sonra DetectDocumentTextAsync() yöntemine iletilir. Bu yöntem bir async yöntemi olduğu için await anahtar kelimesini kullanmalı ve ReturnResult fonksiyonunu async yapmalıyız. Başarı durumunda, sonuç bloklar halinde döndürülür. Her bir bloğu döngüden geçmek için foreach döngüsü kullanılır ve eğer 'WORD' olup olmadığını kontrol eder, ardından metin tanımayı yazdırır. Son olarak, belge işleme için bu yöntemi Main metodunda çağırın.
Çıktı IronOCR'ye benzer, ancak öncelikle dosyanın AWS bucket'a yüklenmesi gerekiyor.
6. Barkod ve QR kodu Metne
IronOCR'un benzersiz bir özelliği, metin tararken belgelerden barkodları ve QR kodlarını okuyabilmesidir. OcrResult.OcrBarcode sınıfının örnekleri, geliştiriciye her taranan barkod hakkında detaylı bilgi verir. AWS Textract bu işlevi sağlamamaktadır.
IronOCR için kod aşağıda verilmiştir:
var Ocr = new IronTesseract();
Ocr.Configuration.ReadBarCodes = true;
using (var input = new OcrInput())
{
input.AddImage("test-files/Barcode.png");
var Result = Ocr.Read(input);
foreach (var Barcode in Result.Barcodes)
{
Console.WriteLine(Barcode.Value);
// type and location properties also exposed
}
}
var Ocr = new IronTesseract();
Ocr.Configuration.ReadBarCodes = true;
using (var input = new OcrInput())
{
input.AddImage("test-files/Barcode.png");
var Result = Ocr.Read(input);
foreach (var Barcode in Result.Barcodes)
{
Console.WriteLine(Barcode.Value);
// type and location properties also exposed
}
}
Dim Ocr = New IronTesseract()
Ocr.Configuration.ReadBarCodes = True
Using input = New OcrInput()
input.AddImage("test-files/Barcode.png")
Dim Result = Ocr.Read(input)
For Each Barcode In Result.Barcodes
Console.WriteLine(Barcode.Value)
' type and location properties also exposed
Next Barcode
End Using
Kod kendini açıklayıcı ve anlaşılması kolay.
7. Lisanslama
IronOCR, geliştirici lisansını ücretsiz olarak sağlayan bir kütüphanedir. Ayrıca kendine özgü bir fiyatlandırma yapısına sahiptir; Lite paket, hiçbir gizli ücret olmadan $999 ile başlar. SaaS ve OEM ürünlerinin yeniden dağıtımı da mümkündür. Tüm lisanslar, 30 günlük para iade garantisi, bir yıl yazılım desteği ve güncellemeleri, geliştirme/test/üretim geçerliliği ve süresiz lisans (tek seferlik satın alma) ile birlikte gelir. IronOCR'un tüm fiyat yapısını ve lisanslama detaylarını görmek için buraya tıklayın.
IronOCR Fiyatlandırma Planı
SaaS ve OEM ürünlerinin yeniden dağıtımı için telif ücretsiz hizmeti sadece bir $1,599 defalık satın alma ile alabilirsiniz.
SAAS Hizmeti
AWS Textract API geliştiricilere AWS Free Tier hizmeti sunar. Amazon Textract ile ücretsiz başlayabilirsiniz. Ücretsiz Katman üç ay sürer ve fiyatlandırma aşağıda gösterilmiştir.

Fiyat Listesi
Bu linkten fiyat detaylarına göz atabilirsiniz. Ayrıca, fiyat hesaplayıcısını kullanarak fiyatları ihtiyaçlarınıza göre ayarlayabilirsiniz.
8. Sonuç
IronOCR, C# geliştiricilerine, bildiğimiz en gelişmiş Tesseract API'sini, herhangi bir platformda sunar. IronOCR, Windows, Linux, Mac, Azure, AWS, Lambda üzerinde dağıtılabilir ve .NET Framework projelerinin yanı sıra .NET Standard ve .NET Core destekler. OCR taramalarında barkodları da okuyabiliriz ve hatta OCR çıktımızı HTML ve aranabilir PDF'ler olarak da dışa aktarabiliriz.
Amazon Textract, belge metni algılama ve analizini uygulamalarınıza eklemeyi kolaylaştırır. Amazon Textract, günlük olarak milyarlarca görüntü ve videoyu analiz etmek için Amazon'un bilgisayarlı görüş bilimcileri tarafından geliştirilen, kanıtlanmış, yüksek ölçeklenebilir, derin öğrenme teknolojisine dayanır. Bunu kullanmak için herhangi bir makine öğrenimi uzmanlığına ihtiyacınız yok. Amazon Textract, resim dosyalarını ve PDF dosyalarını analiz edebilen, basit ve kullanımı kolay API'ler içerir. Amazon Textract, yeni verilerden sürekli olarak öğrenir ve Amazon, hizmete sürekli olarak yeni özellikler ekler.
IronOCR lisansları geliştirici bazlıdır, bu da ürünü kullanacak geliştirici sayısına göre lisans satın almanız gerektiği anlamına gelir. AWS Textract lisansları, bilgileri çıkarmak ve verileri analiz etmek için belgenin sayfa sayısına dayanmaktadır. Lisanslar aylık bazda sunulmaktadır ve fiyatlar, IronOCR lisansına kıyasla çok sayıda sayfa için çok yüksek hale gelmektedir. Ayrıca, IronOCR lisansı tek seferlik bir satın alımdır ve ömür boyu kullanılabilir ve OEM ve SaaS dağıtımını destekler.
Genel karşılaştırmada, IronOCR ve AWS OCR'ın her ikisi de bir belge veya görüntüden metin algılamak için makine öğrenimi yeteneklerine sahiptir. IronOCR, hızı ve zaman tasarrufu açısından AWS OCR'a karşı hafif bir avantaja sahiptir. Kod basittir ve belgelerden metin algılarken doğrudan bir yaklaşıma sahiptir. Görev birkaç yöntemle tamamlanır. Öte yandan, AWS Textract aynı görevi gerçekleştirmek için birçok yöntem kullanır. Bu, sunucu yanıtını artırır ve bazen zaman alıcı olabilir. IronOCR'ye kusursuz olmayan bir belge bile girdiğimizde, belgenin kötü biçimlendirilmiş, eğilmiş ve dijital parazit içermesine rağmen içeriğini yaklaşık %99'luk istatistiksel bir doğrulukla doğru bir şekilde okuyabildiğini görebiliyoruz. IronOCR, ek bir performans ayarlaması yapmaya veya giriş görüntülerini ağır bir şekilde değiştirmeye gerek olmadan, kutusundan çıktığı gibi çalışır. Hız göz alıcı: IronOCR.2020+, önceki sürümlere göre 10 kat daha hızlı ve %250'den fazla daha az hata yapar.
Ayrıca, Iron Software şu anda beş araçlık bir paketi sadece iki fiyatına sunuyor. Iron Suite içinde yer alan araçlar şunlardır:
- IronBarcode IronXL
- IronOCR
- IronPDF IronWebScraper
Iron Suite keşfetmek için lütfen bu bağlantıyı ziyaret edin.
[[i: (AWS Textract ve Tesseract, sahiplerinin tescilli markalarıdır. Bu site, Amazon Web Services veya Google tarafından onaylanmayan, bağlantılı olmayan veya sponsorlanmayan bir sitedir. Tüm ürün adları, logolar ve markalar kendi sahiplerine aittir. Karşılaştırmalar, yalnızca bilgilendirme amaçlıdır ve yazı sırasında halka açık bilgilerle alakalı olarak yansıtılmaktadır.)]]
Sıkça Sorulan Sorular
Optik Karakter Tanıma (OCR) nedir?
Optik Karakter Tanıma (OCR), taranmış kağıt belgeler, PDF'ler veya dijital kamera ile çekilmiş görüntüler gibi farklı türdeki belgeleri düzenlenebilir ve aranabilir verilere dönüştüren bir teknolojidir. IronOCR, bu süreci gelişmiş algoritmalar kullanarak geliştiren güçlü bir C# .NET kütüphanesidir.
C# kullanarak metin görüntülerini makine tarafından okunabilir metne nasıl dönüştürebilirim?
C# .NET kütüphanesi olan IronOCR'yi, metin görüntülerini makine tarafından okunabilir metne dönüştürmek için kullanabilirsiniz. Görüntüleri gelişmiş OCR algoritmaları ile işler ve tanınan metni programatik olarak kolayca düzenlenebilen formatlarda çıktılar.
IronOCR, kusurlu taranmış görüntüleri nasıl işliyor?
IronOCR, kusurlu taranmış görüntüleri etkili bir şekilde yönetip işlemek için tasarlanmıştır. Eğiklik düzeltme, metin kontrastını artırma ve görüntü kalitesini optimize etme gibi ön işleme yetenekleri OCR doğruluğunu artırmak için içerir.
IronOCR'yi çoklu iş parçacıklı işlem için kullanabilir miyim?
Evet, IronOCR çoklu iş parçacığı desteği sunar, bu da aynı anda birden fazla belgeyi işleyerek belge ağırlıklı uygulamalarda performans ve verimliliği önemli ölçüde artırır.
IronOCR, OCR görevleri için hangi dilleri destekler?
IronOCR, 125'ten fazla dili destekler ve bu da onu, birden fazla dilde belgelerin işlenmesi ve metne dönüştürülmesi gereken küresel uygulamaları için çok yönlü bir araç yapar.
IronOCR, Visual Studio projesine nasıl kurulur?
IronOCR, Visual Studio projesine NuGet Paket Yöneticisi aracılığıyla kurulabilir. NuGet konsolunda 'IronOCR' arayarak kurabilir ve böylece .NET uygulamalarınıza OCR fonksiyonunu entegre edebilirsiniz.
IronOCR'nin fiyatlandırma modeli nedir?
IronOCR, süresiz lisanslar dahil olan bir defalık lisanslama modeli sunar ve bu lisanslar 30 günlük para iade garantisi ile birlikte gelir, geliştiriciler için esneklik ve güvence sağlar.
AWS Textract, teknoloji açısından IronOCR'den nasıl farklıdır?
AWS Textract, belge içeriğinin ayrıntılı analizini sağlayan metin ve veri çıkarmak için makine öğrenimi ve derin öğrenme teknolojilerini kullanır. Buna karşılık, IronOCR, kapsamlı dil desteği sunan sağlam bir OCR çözümü sunarak .NET projeleri içinde kullanım ve entegrasyon kolaylığına odaklanır.
IronOCR, barkod ve QR kodlarını okuyabilir ve işleyebilir mi?
Evet, IronOCR, barkod ve QR kodlarını okuyabilir ve işleyebilir. Her bir kod hakkında ayrıntılı bilgi çıkarırken aynı anda metin taraması yaparak belge işleme için kapsamlı bir araç haline getirir.
IronOCR hangi platformlar ve ortamlar tarafından desteklenir?
IronOCR, Windows, Linux, Mac, Azure, AWS ve Lambda dahil olmak üzere geniş bir ortam yelpazesi ile uyumludur. .NET Framework, .NET Standard ve .NET Core projelerini destekleyerek farklı geliştirme ekosistemlerinde esneklik sağlar.

