IRONSOFTWAREHOME
他のコンポーネントと比較する

Tesseract対Microsoft OCR:直接比較

Kannaopat Udonpant
Kannapat Udonpant
Updated: 2026年6月28日

開発者は、C#での光学文字認識(OCR)の際に、Tesseract OCRツールとMicrosoft OCRエンジンのどちらを選ぶかを頻繁に決定する必要があります。 異なる能力、効率性、統合性、使いやすさを持ちながらも、どちらも写真やスキャンされた文書からテキストを抽出するための効果的なOCRツールです。 C#開発のフレームワーク内で、この記事ではTesseract対Microsoft OCRなどの異なるOCRツールの長所、短所、適用性を徹底的に調査します。

OCRとは何ですか?

光学文字認識はOCRと呼ばれます。 これは、スキャンされた画像文書、PDFファイル、デジタルカメラの写真などのさまざまな文書形式を編集可能で検索可能なデータに変換することを可能にする技術です。 画像のフォームやパターンを機械可読のテキストに変換するために、Google Cloud VisionやGoogle Vision OCRなどの異なるOCRツールが画像を分析します。 この技術を使用することで、ユーザーは写真からテキストを抽出し、デジタル文書のように編集、検索、コンテンツを変更できるようになります。

Tesseract OCR

Tesseract OCRは、オープンソースの光学文字認識(OCR)エンジンで、単にTesseractと呼ばれることもあります。 1980年代にヒューレット・パッカード研究所によって初めて開発され、現在はGoogleによって維持されているTesseractは、今日最も人気のあるOCRエンジンの1つです。

Tesseractの主な機能は、画像やスキャンされた文書に含まれるテキストを識別し、それを機械可読なテキストに翻訳することです。 これにより、さまざまなソース、スキャンされた文書の分析、写真、PDFファイルからテキストを抽出することで、テキストを編集可能、検索可能、操作可能にします。

Tesseract OCRの主な特徴

-オープンソース: Tesseractは、Apache License 2.0の条件に基づき、誰でも自由に利用、変更、配布できます。オープンソース設計のおかげで、コミュニティの貢献により、幅広い普及と継続的な機能強化が実現しています。 -言語サポート: Tesseractは、言語に加えて100種類以上の異なる文字体系と文字セットを認識することができます。 多言語対応能力のおかげで、さまざまな言語や地域における幅広いOCRアプリケーションに適しています。 -精度: Tesseractは、特に正しく設定され、適切なデータでトレーニングされた場合、優れたテキスト認識精度でよく知られています。 歪んだ角度、低品質、不十分な照明などのさまざまな問題を抱えた写真から、信頼性の高いテキストを抽出することができます。 -オプション: Tesseractは、豊富な設定およびカスタマイズオプションを提供します。 特定のユースケース向けのOCR性能を最大化するために、ユーザーは複数のパラメーターを調整できます。 さらに、Tesseractは、Java、C++、Python、C#などのさまざまなプラットフォームやコンピュータ言語と組み合わせることで、開発者がさまざまなアプリケーションでその能力を活用できるようにしています。

  • Tesseractは、精度、性能、言語サポートを向上させるために、新しい機能が定期的に追加され、継続的な開発とメンテナンスが行われています。 Tesseractのオープンソースコミュニティは、最先端のOCRツールであり続けることを保証するために、その継続的な開発をサポートしています。

.NET向けTesseract OCRのインストール

Tesseract OCRをコンピュータにインストールすることが最初のステップです。公式のTesseract GitHubリポジトリで、Tesseractインストーラーを入手できます: https://github.com/tesseract-ocr/tesseract.

Tesseract OCRをコンピュータにインストールするには、オペレーティングシステム(Windows、macOS、Linux)に特化したセットアップ手順に従ってください。 Tesseract OCRをインストールした後、Visual StudioのNuGetパッケージマネージャーを使用して、Tesseract.NETラッパーをC#プロジェクトに追加します。

C#プロジェクトをVisual Studioで開き、ツール -> NuGetパッケージマネージャー -> ソリューションのNuGet Packagesを管理に移動します。 NuGetパッケージマネージャーで"Tesseract"を検索し、"Tesseract"または"Tesseract.NET"という名前のパッケージを見つけることができるはずです。 プロジェクトにパッケージを含めるには、選択してインストールをクリックします。

Tesseract と Microsoft OCR (OCR 機能比較): 図1 - Tesseract

Tesseract OCR using C#

C#プロジェクトでTesseractを使用するには、次の手順に従います。

using Tesseract;

class Program
{
    static void Main(string[] args)
    {
        // Initialize the Tesseract engine with the path to your Tesseract installation and the desired language(s)
        using (var engine = new TesseractEngine(@"path_to_tesseract_folder", "eng", EngineMode.Default))
        {
            // Load the image from which to extract text
            using (var img = Pix.LoadFromFile("image.png"))
            {
                // Process the image and extract the text
                using (var page = engine.Process(img))
                {
                    // Get the extracted text
                    var text = page.GetText();
                    Console.WriteLine(text); // Print the extracted text
                }
            }
        }
    }
}

これを達成するには、TesseractEngineのコンストラクタオプションで、Tesseractインストールディレクトリと使用したい言語を指定します。 "path_to_tesseract_folder"をTesseractのインストールディレクトリへの実際のパスに置き換えてください。

C#プロジェクトにTesseractを設定した後の今、写真からテキストを抽出するためのそのOCR機能を活用できます。 TesseractEngineインスタンスは、画像ファイルのパスを"image.png"に置き換えることで、ロードした後にPixクラスを使用してテキストを抽出したり、画像ファイル上でOCRを実行するのに使用できます。

Microsoft OCRとは何ですか?

MicrosoftのCognitive Servicesパッケージには、Microsoft Optical Character Recognitionと呼ばれることもあるMicrosoft OCRが含まれています。 Microsoft Azureは、強化されたテキスト認識能力を備えた文書や写真からテキストを抽出できるクラウドベースの光学文字認識(OCR)ソリューションを提供します。 Microsoft OCRは、ディープニューラルネットワークと機械学習技術を使用して、さまざまなソースからのテキストを優れた精度で認識します。

主要機能

  • Azure Cognitive Servicesとの統合: Microsoft OCRは、AIを活用したMicrosoft Azure APIおよびサービスの集合体であるAzure Cognitive Servicesと連携して機能します。 この接続により、開発者はREST API、SDK、およびクライアントライブラリを使用して、Microsoft OCR機能をアプリケーションおよびワークフローに簡単に統合できます。 -**高い精度とパフォーマンス:**膨大なデータセットでトレーニングされた高度な機械学習モデルにより、Microsoft OCRは高い精度とパフォーマンスでテキスト認識を実現します。 複雑なレイアウトやさまざまなフォントを持つ写真からのテキストを正確に抽出できるので、広範なOCRアプリケーションに適しています。 -拡張性と信頼性: Azure Cognitive Services のコンポーネントである Microsoft OCR は、拡張性と信頼性を備えているため、さまざまな処理要件を持つアプリケーションに適しています。 多くのドキュメントを効率的に管理し、同時に複数のリクエストを処理することで、稼働時間と安定したパフォーマンスを保証します。 -多言語対応: Microsoft OCRは、他のOCRプログラムと同様に、多言語認識に対応しており、ユーザーはさまざまな言語や文字セットで写真からテキストを抽出できます。 多言語サポートのおかげで、さまざまな言語ニーズを持つ世界的なアプリケーションに適しています。

C#プロジェクトで使用するために、Microsoft OCRをAzure Cognitive Services、特にComputer Vision APIと統合する必要があります。 ここに始める方法があります:

Azureアカウントを作成

Azure アカウントをまだ持っていない場合は、作成する必要があります。 無料の Azure アカウントを作成し、試用期間中にいくつかのサービスにアクセスできます。

Azure Cognitive Services の構成

Azure アカウントを持っているときは、Azure Cognitive Services の Computer Vision サービスを構成する必要があります。

  • Azureポータルを開きます。
  • "リソースの作成"をクリックして"Computer Vision"を検索します。
  • Computer Visionサービスを選択したら"作成"をクリックしてください。
  • プロンプトに従って、サブスクリプションと価格層を選択してサービスを設定します。
  • サービスが構築された後、リソースに移動し、サブスクリプションキーとエンドポイントURLを保存してください。 それらはクエリの信頼性を確認するために必要です。

Azure Cognitive Services SDK のインストール

Microsoft Azureを利用することが可能です。 C#プロジェクトをVisual Studioで開き、ツール -> NuGet Package Manager -> ソリューションのNuGet Packagesを管理に移動します。

C# プロジェクトを Visual Studio で開いた後、[ツール] -> [NuGet パッケージ マネージャー] に移動し、[ソリューションの NuGet パッケージを管理] を選択します。

"Microsoft.Azure.CognitiveServices.Vision.ComputerVision"を検索してパッケージをインストールします。

Tesseract と Microsoft OCR (OCR 機能比較): 図2 - Microsoft.Azure.CognitiveServices.Vision.ComputerVision

Microsoft OCR Using C#

SDKをインストールした後、Computer Vision APIを使用してOCRを行うことができます。 画像に対して OCR を行うために Computer Vision API を使用する基本的な例が以下に示されています:

using System;
using Microsoft.Azure.CognitiveServices.Vision.ComputerVision;
using Microsoft.Azure.CognitiveServices.Vision.ComputerVision.Models;
using System.Threading.Tasks;

class Program
{
    static async Task Main(string[] args)
    {
        // Set your endpoint and subscription key for authentication
        var endpoint = "YOUR_ENDPOINT";
        var subscriptionKey = "YOUR_SUBSCRIPTION_KEY";

        // Create a new instance of the ComputerVisionClient
        var client = new ComputerVisionClient(new ApiKeyServiceClientCredentials(subscriptionKey))
        {
            Endpoint = endpoint
        };

        // Perform OCR on the specified image
        var result = await client.RecognizePrintedTextInStreamAsync(true, "image.png");

        // Iterate over the results and print the recognized text
        foreach (var region in result.Regions)
        {
            foreach (var line in region.Lines)
            {
                foreach (var word in line.Words)
                {
                    Console.WriteLine(word.Text);
                }
            }
        }
    }
}

画像ファイル上でOCRを実行するには、上記のコードサンプルで"image.png"を画像ファイルへのパスに置き換えます。このコードは、Computer Vision API に送信して画像から認識されたテキストを取得します。 Azure Cognitive ServicesでComputer Visionサービスを設定した後に取得したエンドポイントURLとサブスクリプションキーを、それぞれ"YOUR_SUBSCRIPTION_KEY"に置き換えてください。

IronOCRとは何ですか?

PDF、写真、その他のメディアからのテキスト抽出のための使いやすいAPIを提供します。 .NETコンポーネントとライブラリを専門とするソフトウェア開発企業のIron SoftwareがIronOCRを作成し、維持しています。 - 簡単な統合: IronOCRをあなたのC#またはVB.NETプロジェクトに簡単に組み込むには、NuGetパッケージを使用するか、プロジェクトにライブラリを直接アクセスしてください。

IronOCRの主な機能

-簡単な統合: NuGetパッケージを利用するか、プロジェクト内でライブラリに直接アクセスすることで、 IronOCR をC# または VB .NETプロジェクトに簡単に組み込むことができます。 -多機能OCR: IronOCRは、スクリーンショット、スキャンした文書、PDFファイル、写真など、幅広いソースからテキストを認識できます。また、BMP、TIFF、PNG、JPEGなど、複数の画像形式に対応しています。 -高精度なテキスト認識: IronOCRは、高度なOCRアルゴリズムを利用することで、優れたテキスト認識精度を実現しています。 - 複数言語に対応: IronOCRは複数の言語を認識できるため、多言語アプリケーションに適しています。 -多言語対応: IronOCRは複数の言語を認識できるため、多言語アプリケーションに適しています。 - PDFテキスト抽出: IronOCRはスキャンされたPDFと画像ベースのPDFの両方からテキストを抽出できます。

  • **PDFテキスト抽出:**スキャンされたPDFと画像ベースのPDFの両方から、 IronOCRによってテキストを抽出できます。 - 画像の前処理: OCR処理前に、IronOCRは受けた画像のクオリティを向上させるために画像の前処理機能を持っています。 -画像前処理: OCR処理を行う前に、 IronOCRは画像前処理機能によって入力画像の品質を向上させることができます。 これには、デスキュー、コントラストの変更、ノイズの削減などのタスクが含まれます。

IronOCR Using C#

こちらが IronOCR を使用した基本的な C# の例です:

// Create an instance of IronTesseract
var Ocr = new IronTesseract(); // nothing to configure
// Set the language and Tesseract version to be used for OCR
Ocr.Language = OcrLanguage.EnglishBest;
Ocr.Configuration.TesseractVersion = TesseractVersion.Tesseract5;

// Prepare the image input and perform OCR
using (var Input = new OcrInput())
{
    // Add the image for OCR processing
    Input.AddImage(@"Demo.png");
    // Read the text from the image
    var Result = Ocr.Read(Input);
    // Print the recognized text
    Console.WriteLine(Result.Text);
    Console.ReadKey(); // Wait for user input before closing
}

上記のコードを使用して、最高のOCR精度で画像からデータを抽出できます。 さらに、IronOCRは文書から抽出されたテキストをWordを含む編集可能なファイル形式に変換することを容易にします。 スキャンした文書も検索可能なPDFに変換できます。 コードについて詳しくはこちらを参照してください。 コードの詳細については、こちらをご覧ください。

ソース画像:

Tesseract と Microsoft OCR (OCR 機能比較): 図3 - 入力画像

結果:

Tesseract と Microsoft OCR (OCR 機能比較): 図4 - コンソール出力

結論

結論として、Tesseract と Microsoft OCR は、それぞれ独自の利点と欠点を持ち、C# 開発者に強力な OCR 機能を提供します。 Tesseract はカスタマイズ性と柔軟性を提供するため、多くの微調整を必要とするアプリケーションに適しています。 C#プロジェクト向けにTesseractとMicrosoft OCRの間で選択する際に、開発者は個々のニーズ、変更の必要性、財政的制約を評価する必要があります。 最後にIronOCRは、卓越した統合、柔軟性、および精度を提供する目立つOCRソリューションです。

その比類のない精度、進化したアルゴリズム、およびさまざまな文書タイプを特定する能力のおかげで、IronOCRは現在市場で最高のOCRソリューションです。 その比類のない精度、高度なアルゴリズム、さまざまな文書タイプを認識する能力により、IronOCRは現在市場で最高のOCRソリューションです。 IronOCRの開発版を無料で試すことができ、IronOCRパッケージを購入すると生涯ライセンスが得られます。

IronOCRの手頃な開発版を無料で試すことができ、IronOCRパッケージを購入すると、生涯ライセンスが得られます。 開始価格が$999からのIronOCRバンドルは、複数のデバイスで使える単一の価格提供で非常にお得です。 詳細については、IronOCR の ウェブサイトをご覧ください。 このリンクをクリックして、Iron Software製品についてもっと学びましょう。

このサイトは、TesseractまたはMicrosoft OCRと提携、承認、または支援されていません。 このサイトは、Tesseract または Microsoft OCR と提携、承認、または後援されていません。 すべての製品名、ロゴ、およびブランドは各所有者の所有物です。 比較は情報提供のみを目的としており、執筆時点で公開されている情報を反映しています。)}]

関連する記事

Key in blue circle

無料の30日間トライアルキーをすぐに入手してください。

Your trial license will be sent to your email address

制限なし。100% ロック解除済み。クレジットカード不要。

bullet_checkedクレジットカードやアカウントの作成は不要です。制限なし。100% ロック解除済み。クレジットカード不要。
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried IronPDF
義務のない相談を受ける
下記のフォームを記入するか、sales@ironsoftware.comにメールしてください。
あなたの詳細は常に守秘されます。
世界中の数百万人のエンジニアから信頼されています。
ライセンスはより安く
あなたの無料30日間の試用キーをすぐに入手。
クレジットカードやアカウントの作成は不要です。