IRONSOFTWAREHOME
IRONOCRの使い方

より高速で効率的な OCR 処理のための最適化されたパフォーマンス

Kannaopat Udonpant
Kannapat Udonpant
Updated: 2026年4月21日

2024.12 に IronOCR複数ページの TIFF 画像を処理する際に生成される検索可能な PDF のファイルサイズを大幅に削減する機能を導入しました。 この改善により出力ファイルが小さくなった一方で、処理速度とメモリ使用におけるパフォーマンスの課題も導入されました。

初期の最適化は 2025.1 でこれらのパフォーマンス問題に対処し始めました。 その後、包括的なパフォーマンス向上が2025年2月のリリースで提供され、マルチページ文書を扱う際の速度とメモリの課題を解決しながらファイルサイズの小ささを維持しました。


ボトルネックの特定:ページの回転と処理時間

主要なパフォーマンスのボトルネックはページ回転でした。 各操作が新しいインスタンスを作成し、既存のものを再利用せず、不要な処理時間とメモリ消費を引き起こしていました。 この非効率性は、特に大きなTIFFを検索可能なPDFに変換するときに、処理時間とメモリ消費の増加をもたらしました。

最適化バージョン (IronOCR 2025.2)

IronOCR 2025.1の初期の修正は、ページ回転のためのインスタンス再利用の最適化に焦点を当てていました。 これにより処理時間が63秒から57秒に10%程度の改善が見られました。 しかし、これは始まりにすぎませんでした。

さらに深く掘り下げると、改善のためのいくつかの他の領域が特定されました。


体系的なパフォーマンス向上

改善の主要箇所

  • 繰り返し操作のためのインスタンスの再利用
  • 同時処理の最適化
  • メモリアロケーション & オブジェクトライフサイクル管理
  • 検索可能なPDFレンダリングの改善

これらの最適化のそれぞれが次のものに基づいて構築され、IronOCR 2025.2 の画期的な改良につながりました。


主要な観察: 何が変わったのか?

これらの強化により、IronOCR 2025.2 のアップデートは大幅なパフォーマンス向上を実現しました:

処理速度の向上:

  • 24ページの検索可能なPDFは現在49%速く処理されます(63s → 32s)。
  • 複数ドキュメント処理は**45%**改善されました。
  • 単一画像OCR35%速くなっています。

メモリ使用効率の向上:

  • オブジェクトの割り当てが最大63%減少しました。
  • メモリの断片化が少なく、パフォーマンスが滑らかになりました。

ベンチマーク結果

ReadSimpleImage:

  • 2025.2バージョン:868.1ms、2024.11バージョンより16.27%速く、2025.1バージョンより34.83%速い。

最適化されたOCR処理1

  • メモリ:81.65MB、2024.11バージョンより31.27%少なく、2024.12バージョンより42.12%少ない。

最適化されたOCR処理2

ReadMultipleDocs:

最適化バージョン(2025.2):20706.6ms、(2024.11)バージョンより15.61%速い。

最適化されたOCR処理3

  • メモリ:1.2GB、レガシーバージョンより4.76%少ない。
  • Pdfiumバージョン:ベンチマークで不合格

最適化されたOCR処理4

実世界のアプリケーション:企業が得られる利点

法律とコンプライアンス: より早い文書デジタル化

以前、法律事務所が複数のページでスキャンされた契約書を扱う際に、OCR処理が遅れていました。 IronOCR 2025.2 を使用すると、契約を検索可能な PDF に変換する速度が約 50 % 向上し、ケース調査やコンプライアンス チェックが簡素化されます。

医療: 効率的な医療記録処理

病院やクリニックは患者記録の大規模なTIFFスキャンを頻繁に扱います。 以前は、24ページの病歴文書を検索可能なPDFに変換するのに1分以上かかっていました。 現在では、メモリ管理と並行処理の改善により、この作業が32秒で完了し、重要な患者データへの素早いアクセスが可能になっています。

財務と監査: 大量レポートの取り扱い

会計事務所は何百ページもの財務諸表をスキャンするため、テキストが検索可能でありながらファイルサイズを管理しやすく保つソリューションが必要でした。 IronOCRの改良されたレンダリングを用いることで、複数の文書を効率的にスキャン処理し、処理時間と最終ファイルサイズの両方を削減できます。

研究とアーカイブ: 歴史的文書の保存

スキャンされた研究論文や歴史的文書を扱うアーカイブ業者は、正確なテキスト認識を必要としながらも、ストレージに対するファイルの軽量化を求めています。 最新の最適化により、大規模な文書変換を圧倒的に低い処理オーバーヘッドで扱うことができるようになりました。


検索可能なPDFの進化: プロセスであり、単なるジャンプではありません

最適化は一回の跳躍ではなく、現実の課題によって形作られる段階的なプロセスです。

  1. 2024.11 :****検索可能なPDFファイルのファイルサイズ削減機能を導入したが、パフォーマンス上の制限に直面した。
  2. 2024.12 :****レンダリングの改善によりPDFファイルのサイズは縮小したが、大きなTIFFファイルでは速度とメモリの問題が明らかになった。
  3. 2025.1 :****ページ回転処理における最初のボトルネックを解消し、処理時間を**10%**短縮しました。
  4. 2025.2: 包括的な最適化により、49%のパフォーマンス向上、メモリ効率の改善、そして大きな検索可能なPDFのよりスムーズな処理を実現しました。

各更新は前の教訓に基づいており、より速く、より効率的で、高需要のワークロードに対応したOCRエンジンを実現しています。


最新の IronOCR アップデートの力を体感してください

ビジネスが迅速で効率的かつ正確なOCR処理に依存している場合、このIronOCR 2025.2アップデートは必要なスピードと最適化を提供します。

30日間の無料トライアルキーを試す とプロセスを体験してください!

関連する記事

Key in blue circle

無料の30日間トライアルキーをすぐに入手してください。

Your trial license will be sent to your email address

制限なし。100% ロック解除済み。クレジットカード不要。

bullet_checkedクレジットカードやアカウントの作成は不要です。制限なし。100% ロック解除済み。クレジットカード不要。
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried IronPDF
義務のない相談を受ける
下記のフォームを記入するか、sales@ironsoftware.comにメールしてください。
あなたの詳細は常に守秘されます。
世界中の数百万人のエンジニアから信頼されています。
ライセンスはより安く
あなたの無料30日間の試用キーをすぐに入手。
クレジットカードやアカウントの作成は不要です。