IRONSOFTWAREHOME
DIĞER BILEŞENLERLE KARŞILAŞTIRIN

Tesseract vs Microsoft OCR: Başabaş Karşılaştırma

Curtis Chau
Curtis Chau
Updated: 28 Haziran 2026

Geliştiriciler genellikle C#'de Optik Karakter Tanıma (OCR) konusunda Tesseract OCR aracını ve Microsoft OCR motorunu seçmek zorundadır. Farklı yeteneklere, verimliliğe, entegrasyona ve kolaylığa sahip olmasına rağmen, her ikisi de fotoğraflardan veya taralı belgelerden metin çıkarmak için etkili OCR araçlarıdır. C# geliştirme çerçevesi içerisinde, bu makalede Tesseract ve Microsoft OCR gibi farklı OCR araçlarının artılarını, eksilerini ve kullanılabilirliğini ayrıntılı olarak inceleyeceğiz.

OCR Nedir?

Optik Karakter Tanıma, OCR olarak adlandırılır. Bu, taranmış görüntü belgeleri, PDF dosyaları veya dijital kamera fotoğrafları gibi çeşitli belge formatlarını düzenlenebilir ve aranabilir verilere dönüştürmeyi mümkün kılan bir teknolojidir. Google Cloud Vision veya Google Vision OCR gibi farklı OCR araçları, bir görüntünün form ve desenlerini makine tarafından okunabilir metne dönüştürmek için görüntüleri analiz eder. Bu teknik kullanılarak, kullanıcılar fotoğraflardan metin çekip, içeriği dijital bir belgeyle olduğu gibi düzenleyebilir, arayabilir ve değiştirebilirler.

Tesseract OCR

Tesseract OCR, bazen sadece Tesseract olarak anılan, açık kaynaklı bir optik karakter tanıma (OCR) motorudur. 1980'lerde Hewlett-Packard Laboratories tarafından başlangıçta geliştirilen ve şu anda Google tarafından bakım yapılan Tesseract, bugün kullanılan en popüler OCR motorlarından biridir.

Tesseract'ın birincil işlevi, resimlerde bulunan metni tanımlamak veya taranmış belgeleri işlemek ve bunları makine tarafından okunabilir metne çevirmektir. Bu, kullanıcıların taranmış belge analizi, fotoğraflar ve PDF dosyaları gibi çeşitli kaynaklardan metin çıkarmasını sağlayarak metni düzenlenebilir, aranabilir ve manipüle edilebilir hale getirir.

Tesseract OCR'nin Temel Özellikleri

  • Açık Kaynak: Tesseract, Apache Lisansı 2.0 şartları altında herkesin kullanması, değiştirmesi ve dağıtması için ücretsizdir. Topluluk katkıları sayesinde, açık kaynaklı tasarımı, geniş çapta benimsenmesine ve sürekli olarak geliştirilmesine büyük ölçüde yardımcı olmuştur.
  • Dil Desteği: Tesseract, dillerin yanı sıra 100'den fazla farklı yazı tipi ve karakter setini tanıyabilme kapasitesine sahiptir. Çok dilli yeteneği nedeniyle, farklı dillerde ve coğrafi bölgelerde geniş bir OCR uygulamaları yelpazesi için uygundur.
  • Doğruluk: Tesseract, özellikle doğru bir şekilde yapılandırıldığında ve ilgili verilerle eğitildiğinde, mükemmel metin tanıma doğruluğu ile tanınır. Eğik açılar, düşük kalite ve yetersiz aydınlatma gibi çeşitli sorunlar olan fotoğraflardan güvenilir bir şekilde metin çıkarabilir.
  • Seçenekler: Tesseract, büyük ölçüde yapılandırma ve özelleştirme seçenekleri sunar. Belirli kullanım durumları için kullanıcılar, OCR performansını en üst düzeye çıkarmak için birkaç parametreyi ayarlayabilir. Ayrıca, Tesseract Java, C++, Python ve C# gibi çeşitli platformlar ve bilgisayar dilleri ile birleştirilebilir ve bu da geliştiricilerin geniş bir uygulama yelpazesinde yeteneklerinden yararlanmalarını sağlar.
  • Tesseract, doğruluğunu, performansını ve dil desteğini artırmak için düzenli olarak yeni özelliklerin eklendiği sürekli bir geliştirme ve bakım sürecinden geçer. Tesseract'ın açık kaynak topluluğu, sürekli gelişimini destekler ve bu da her zaman en son OCR aracı olmasını garanti eder.

.NET İçin Tesseract OCR Kurulumu

Bilgisayarınıza Tesseract OCR kurmak ilk adımdır. Tesseract yükleyicisini https://github.com/tesseract-ocr/tesseract adresinden resmi Tesseract GitHub deposundan alabilirsiniz.

Bilgisayarınıza Tesseract OCR kurmak için işletim sisteminize (Windows, macOS veya Linux) özgü kurulum talimatlarını izleyin. Tesseract OCR kurulduktan sonra, C# projenize Tesseract.NET sarıcısını eklemek için Visual Studio'nun NuGet Paket Yöneticisini kullanın.

C# projenizi Visual Studio'da açtıktan sonra Araçlar -> NuGet Paket Yöneticisi -> Çözüm için NuGet Paketlerini Yönet'e gidin. NuGet Paket Yöneticisinde "Tesseract" veya "Tesseract.NET" adlı paketi bulabilmelisiniz. Projeye paketi dahil etmek için seçin ve Yükle'ye tıklayın.

Tesseract vs Microsoft OCR (OCR Özellikleri Karşılaştırması): Şekil 1 - Tesseract

Tesseract OCR using C#

C# projenizde Tesseract'ı kullanmak için şu adımları izleyin:

using Tesseract;

class Program
{
    static void Main(string[] args)
    {
        // Initialize the Tesseract engine with the path to your Tesseract installation and the desired language(s)
        using (var engine = new TesseractEngine(@"path_to_tesseract_folder", "eng", EngineMode.Default))
        {
            // Load the image from which to extract text
            using (var img = Pix.LoadFromFile("image.png"))
            {
                // Process the image and extract the text
                using (var page = engine.Process(img))
                {
                    // Get the extracted text
                    var text = page.GetText();
                    Console.WriteLine(text); // Print the extracted text
                }
            }
        }
    }
}

Bunu gerçekleştirmek için, Tesseract Motoru'nun constructor seçeneklerinde Tesseract kurulum dizininizin yerini ve kullanmak istediğiniz dili veya dilleri belirtin. "eng" ile kullanmak istediğiniz dil veya diller için dil kodunu ve "path_to_tesseract_folder" ile Tesseract kurulum dizininizin gerçek yolunu değiştirin (ör. İngilizce için "eng").

C# projenizde Tesseract'ı kurduktan sonra, artık resimlerden metin çıkarmak için OCR özelliklerini kullanabilirsiniz. TesseractEngine örneği, bir resim yüklendiğinde Pix sınıfı kullanılarak işlenebilir, metin çıkarmak veya bir resim dosyasında OCR çalıştırmak için, "image.png" ile resim dosyasının yolunu değiştirin.

Microsoft OCR nedir?

Microsoft'un Bilişsel Hizmetler paketi, bazen Microsoft Optik Karakter Tanıma olarak da adlandırılan Microsoft OCRyi içerir. Microsoft Azure, artan metin tanıma yetenekleriyle belgelerden ve fotoğraflardan metin çıkarabilen bulut tabanlı bir optik karakter tanıma (OCR) çözümü sunar. Microsoft OCR, çeşitli kaynaklardan metin tanımak için derin sinir ağları ve makine öğrenme tekniklerini kullanır, bu da mükemmel doğrulukla sonuçlanır.

Başlıca Özellikler

  • Azure Bilişsel Hizmetleri ile Entegrasyon: Microsoft OCR, bir dizi AI destekli Microsoft Azure API'leri ve hizmetleri koleksiyonu olan Azure Bilişsel Hizmetleri ile uyum içinde çalışır. Bu bağlantı ile, geliştiriciler REST API'leri, SDK'lar ve istemci kütüphaneleri kullanarak Microsoft OCR işlevlerini uygulamalara ve iş akışlarına kolayca entegre edebilir.
  • Yüksek Doğruluk ve Performans: Microsoft OCR, devasa veri kümeleri üzerinde eğitilmiş sofistike makine öğrenimi modelleri sayesinde yüksek doğruluk ve performansla metin tanıması sağlar. Karmaşık düzenlere ve çeşitli yazı tiplerine sahip fotoğraflardan metinleri hassas bir şekilde çıkarabilme yeteneği ile geniş bir OCR uygulama yelpazesi için uygundur.
  • Ölçeklenebilirlik ve Güvenilirlik: Azure Cognitive Services'in bir bileşeni olan Microsoft OCR, farklı işlem gereksinimleri olan uygulamalar için uygun hale getirerek ölçeklenebilirlik ve güvenilirlik sağlar. Aynı anda yüksek belge miktarlarını ve birden fazla isteği etkili bir şekilde yönetebilir, çalışma süresi ve istikrarlı performans sağlar.
  • Çok Dilli Destek: Diğer OCR programları gibi Microsoft OCR, kullanıcıların çeşitli dillerde ve karakter setlerinde fotoğraflardan metin çıkarmasına izin vererek çok dilli tanıma sağlar. Çok dilli desteği sayesinde çeşitli dil ihtiyaçları olan küresel uygulamalar için uygundur.

Onu bir C# projesinde kullanmak için Microsoft OCR'yi özellikle Azure Cognitive Services ile, bilhassa Computer Vision API ile birleştirmeniz gerekir. İşte nasıl başlayabileceğiniz:

Bir Azure Hesabı Oluşturun

Zaten bir Azure hesabınız yoksa bir Azure hesabı oluşturmanız gerekir. Deneme süresi boyunca ücretsiz bir Azure hesabı oluşturabilir ve çeşitli hizmetlere erişebilirsiniz.

Azure Cognitive Services'i Yapılandırın

Bir Azure hesabınız olduğunda, Azure Cognitive Services içindeki Computer Vision hizmeti yapılandırılmalıdır.

  • Azure Portalıni açın.
  • "Bir kaynak oluştur" a tıklayarak "Computer Vision" u arayın.
  • Computer Vision hizmetini seçtikten sonra "Oluştur" a tıklayın.
  • Hizmeti yapılandırmak için talimatları izleyerek aboneliği ve fiyat katmanını seçin.
  • Hizmet oluşturulduktan sonra kaynağa gidin ve abonelik anahtarını ve uç nokta URL'sini kaydedin; sorgularınızın kimliğini doğrulamak için onlara ihtiyacınız olacak.

Azure Cognitive Services SDK'sını Yükleyin

Microsoft Azure'u kullanmak mümkündür. C# projenizde Computer Vision API ile iletişim kurmak için CognitiveServices.Vision.ComputerVision NuGet paketini kullanın.

Visual Studio'da C# projenizi açtıktan sonra Araçlar -> NuGet Paket Yöneticisi sonra Çözüm İçin NuGet Paketlerini Yönet'e gidin.

"Microsoft.Azure.CognitiveServices.Vision.ComputerVision"'ı aratarak paketi yükleyin.

Tesseract vs Microsoft OCR (OCR Özellikleri Karşılaştırması): Şekil 2 - Microsoft.Azure.CognitiveServices.Vision.ComputerVision

Microsoft OCR Using C#

SDK yüklendikten sonra, OCR yapmak için Computer Vision API'yi kullanabilirsiniz. Computer Vision API'yi kullanarak bir görüntüde OCR yapmanın giriş niteliğinde bir örneği aşağıda bulabilirsiniz:

using System;
using Microsoft.Azure.CognitiveServices.Vision.ComputerVision;
using Microsoft.Azure.CognitiveServices.Vision.ComputerVision.Models;
using System.Threading.Tasks;

class Program
{
    static async Task Main(string[] args)
    {
        // Set your endpoint and subscription key for authentication
        var endpoint = "YOUR_ENDPOINT";
        var subscriptionKey = "YOUR_SUBSCRIPTION_KEY";

        // Create a new instance of the ComputerVisionClient
        var client = new ComputerVisionClient(new ApiKeyServiceClientCredentials(subscriptionKey))
        {
            Endpoint = endpoint
        };

        // Perform OCR on the specified image
        var result = await client.RecognizePrintedTextInStreamAsync(true, "image.png");

        // Iterate over the results and print the recognized text
        foreach (var region in result.Regions)
        {
            foreach (var line in region.Lines)
            {
                foreach (var word in line.Words)
                {
                    Console.WriteLine(word.Text);
                }
            }
        }
    }
}

Bir resim dosyasında OCR gerçekleştirmek için, yukarıdaki kod örneğinde "image.png" ile resim dosyasının yolunu değiştirin. Bu kod, resmi Computer Vision API'ye göndererek tanınan metni geri alacaktır. Azure Cognitive Services'de Bilgisayar Görüsü hizmetini yapılandırdıktan sonra aldığınız uç nokta URL'si ve abonelik anahtarı yerine "YOUR_ENDPOINT" ve "YOUR_SUBSCRIPTION_KEY" öğelerini koyun.

IronOCR Nedir?

Geliştiriciler, IronOCR, bir .NET OCR kütüphanesi ile C# veya VB.NET uygulamalarına metin tanıma özelliklerini entegre edebilirler. Bu, PDF'lerden, resimlerden ve diğer medya türlerinden metin çıkarmak için kullanıcı dostu bir API sunar. Iron Software, .NET bileşenleri ve kütüphaneleri konusunda uzmanlaşmış bir yazılım geliştirme şirketidir, IronOCR'yi oluşturur ve geliştirir.

IronOCR'nin Temel Özellikleri

  • Basit Entegrasyon: IronOCR'yi C# veya VB.NET projelerinize kolayca, NuGet paketlerini kullanarak veya kütüphaneye doğrudan projenizden erişerek entegre edebilirsiniz.
  • Çok Yönlü OCR: IronOCR, ekran görüntüleri, taranmış belgeler, PDF dosyaları ve fotoğraflar gibi çeşitli kaynaklardan metin tanıyabilir. BMP, TIFF, PNG ve JPEG dahil olmak üzere çeşitli görüntü türlerini işleyebilir.
  • Doğru Metin Tanıma: IronOCR, gelişmiş OCR algoritmalarını kullanarak mükemmel metin tanıma doğruluğu sağlar. Farklı çözünürlükler, yazı tipleri ve arka planları olan fotoğraflardan metinler güvenilir bir şekilde çıkarılabilir.
  • Birden Çok Dil İçin Destek: IronOCR, birden fazla dili tanıyabildiği için çok dilli uygulamalar için uygundur. Popüler diller için özelleştirilmiş dil eğitimine izin verir ve yerleşik dil paketleri ile birlikte gelir.
  • PDF Metin Çıkartma: IronOCR, taranmış ve görüntü tabanlı PDF'lerden metin çıkarabilir. PDF belgelerinden metin çıkarırken, içeriğin orijinal formatını ve düzenini koruyabilir.
  • Görüntü Ön İşleme: IronOCR, OCR işlemesinden önce gelen görüntülerin kalitesini görüntü ön işleme özellikleriyle artırabilir. Bu işlemler arasında, eğrilik düzeltme, kontrast ayarlama ve gürültü azaltma gibi görevler yer alır.

IronOCR Using C#

İşte IronOCR kullanarak basit bir C# örneği:

// Create an instance of IronTesseract
var Ocr = new IronTesseract(); // nothing to configure
// Set the language and Tesseract version to be used for OCR
Ocr.Language = OcrLanguage.EnglishBest;
Ocr.Configuration.TesseractVersion = TesseractVersion.Tesseract5;

// Prepare the image input and perform OCR
using (var Input = new OcrInput())
{
    // Add the image for OCR processing
    Input.AddImage(@"Demo.png");
    // Read the text from the image
    var Result = Ocr.Read(Input);
    // Print the recognized text
    Console.WriteLine(Result.Text);
    Console.ReadKey(); // Wait for user input before closing
}

Yukarıda belirtilen kodu kullanarak en yüksek OCR doğruluğunda görüntüden veri çıkarabiliriz. Ek olarak, IronOCR, belgelerden çıkarılan metni, Word dahil olmak üzere düzenlenebilir dosya formatlarına dönüştürmeyi kolaylaştırır. Taranmış belgeyi ayrıca arama yapılabilir bir PDF'ye dönüştürebiliriz. IronOCR ile sonuç, çeşitli OCR çıkış formatlarında saklanabilir. Kod hakkında daha fazla bilgi edinmek için burayı ziyaret edin.

Kaynak Görüntü:

Tesseract vs Microsoft OCR (OCR Özellikleri Karşılaştırması): Şekil 3 - Girdi Resmi

Sonuç:

Tesseract vs Microsoft OCR (OCR Özellikleri Karşılaştırması): Şekil 4 - Konsol Çıkışı

Sonuç

Sonuç olarak, her biri benzersiz avantajları ve dezavantajları olan Tesseract ve Microsoft OCR, C# geliştiricileri için güçlü OCR yetenekleri sunar. Tesseract, özelleştirme ve esneklik sunduğundan, ince ayar gerektiren uygulamalar için iyi bir seçenektir. Ancak, Microsoft OCR, yüksek doğruluğu, ölçeklenebilirliği ve Azure hizmetleri ile sorunsuz bağlantısı nedeniyle C# uygulamaları için gelişmiş metin tanıma yeteneklerine ihtiyaç duyanlar için en iyi seçenektir. Geliştiriciler, C# projeleri için Tesseract ve Microsoft OCR arasında karar vermeden önce bireysel ihtiyaçlarını, değişiklik gereksinimlerini ve finansal sınırlarını değerlendirmelidir.

Son olarak, IronOCR olağanüstü entegrasyon, esneklik ve doğruluk sunan dikkate değer bir OCR çözümüdür. Benzersiz doğruluğu, gelişmiş algoritmaları ve birçok belge türünü tanıma kapasitesi nedeniyle, IronOCR şu anda piyasadaki en iyi OCR çözümüdür. IronOCR, sayısız belge ve yaygın bilgisayar dili arasında sorunsuzca entegre olduğundan, sezgisel bir arayüz sunarken geliştirici erişilebilirliğini garanti eder.

IronOCR'un uygun fiyatlı geliştirme sürümünü ücretsiz deneyebilir ve IronOCR paketini satın alırsanız ömür boyu lisans alırsınız. Başlangıç fiyatı $999 olan IronOCR paketi, birden fazla cihaz için tek bir fiyat sunduğu için mükemmel bir değerdir. Maliyet hakkında daha fazla bilgi için IronOCR web sitesini ziyaret edin. Iron Software ürünleri hakkında daha fazla bilgi almak için bu bağlantıya tıklayın.

Lütfen dikkate alın: Tesseract ve Microsoft OCR, kendi sahiplerinin tescilli markalarıdır. Bu site, Tesseract veya Microsoft OCR ile ilişkili, onaylı veya sponsorlu değildir. Tüm ürün adları, logolar ve markalar kendi sahiplerine aittir. Karşılaştırmalar, yalnızca bilgilendirme amaçlıdır ve yazı sırasında halka açık bilgilerle alakalı olarak yansıtılmaktadır.
Curtis Chau
Teknik Yazar

Curtis Chau, Bilgisayar Bilimleri alanında Lisans Derecesine (Carleton Üniversitesi) sahip ve Node.js, TypeScript, JavaScript ve React konularında uzmanlaşmış ön uç geliştirmeyle ilgileniyor. Sezgisel ve estetik açıdan hoş kullanıcı arayüzleri oluşturma tutkunu, Curtis modern çerçevelerle çalışmayı ve iyi yapılandırılmış, görsel olarak çekici kılavuzlar oluşturmayı seviyor.

...
Daha Fazla Oku

İlgili Makaleler

Key in blue circle

Ücretsiz 30 günlük Deneme Anahtarınızı anında edinin.

Your trial license will be sent to your email address

Herhangi bir sınırlama yoktur. %100 erişim. Kredi kartı gerekmez.

bullet_checkedKredi kartı veya hesap oluşturma gerektirmezHerhangi bir sınırlama yoktur. %100 erişim. Kredi kartı gerekmez.
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried IronPDF
Bağımsız Danışmanlık Alın
Aşağıdaki formu doldurun veya sales@ironsoftware.com adresine e-posta gönderin
Bilgileriniz daima gizli kalacaktır.
Dünya Çapında Milyonlarca Mühendisin Güvendiği
Iron Software müşteri logoları
Ücretsiz 30 Günlük Deneme Anahtarınızı anında alın.
Kredi kartı veya hesap oluşturma gerektirmez