IRONSOFTWAREHOME
UTILISATION D'IRONOCR

Performances optimisées pour un traitement OCR plus rapide et plus efficace

Kannaopat Udonpant
Kannapat Udonpant
Updated: 21 avril 2026

En 2024.12, IronOCR a introduit une fonctionnalité qui a significativement réduit la taille des fichiers des PDF générés lors du traitement des images TIFF multipages. Bien que cette amélioration ait permis de réduire la taille des fichiers sortis, elle a également introduit des défis de performance concernant la vitesse de traitement et l'utilisation de la mémoire.

Les optimisations initiales en 2025.1 ont commencé à résoudre ces problèmes de performance. Les améliorations de performance complètes ont été livrées dans la version 2025.2, qui a conservé les tailles de fichier réduites tout en résolvant les défis de vitesse et de mémoire lors du traitement des documents multipages.


Identifier le goulot d'étranglement : Rotation des pages et temps de traitement

Un des principaux goulots d'étranglement de la performance était la rotation des pages. Chaque opération créait une nouvelle instance au lieu de réutiliser les existantes, entraînant un temps de traitement et une consommation de mémoire inutiles. Cette inefficacité résultait en un temps de traitement et une consommation de mémoire accrus, en particulier lors de la conversion de grands TIFF en PDF consultables.

Version d'optimisation (IronOCR 2025.2)

La correction initiale dans IronOCR 2025.1 a porté sur l'optimisation de la réutilisation des instances pour la rotation des pages. Cela a conduit à une amélioration modeste de 10%, réduisant le temps de traitement de 63 secondes à 57 secondes. Mais ce n'était que le début.

En approfondissant, nous avons identifié plusieurs autres domaines d'amélioration.


Améliorations systématiques des performances

Principaux domaines d'amélioration

  • Réutilisation des instances pour des opérations répétées
  • Optimisation du traitement concurrent
  • Allocation de mémoire et gestion du cycle de vie des objets
  • Améliorations du rendu des PDF consultables

Chacune de ces optimisations s'appuyant sur la précédente, conduisant aux améliorations révolutionnaires dans IronOCR 2025.2.


Observations clés : Qu'est-ce qui a changé ?

Avec ces améliorations, la mise à jour IronOCR 2025.2 a apporté des améliorations significatives des performances :

Traitement plus rapide :

  • Les PDF consultables de 24 pages sont désormais traités 49% plus vite (63s → 32s).
  • Le traitement de multi-documents a été amélioré de 45%.
  • L'OCR d'une seule image est 35% plus rapide.

Utilisation plus efficace de la mémoire :

  • Les allocations d'objets ont été réduites jusqu'à 63%.
  • Moins de fragmentation mémoire a conduit à des performances plus fluides.

Résultats des benchmarks

ReadSimpleImage :

  • Version 2025.2 : 867,1 ms, soit 16,27% plus rapide que la version 2024.11, 34,83% plus rapide que la version 2025.1.

Traitement OCR optimisé 1

  • Mémoire : 81,65 Mo, 31,27% de moins que la version 2024.11, 42,12% de moins que la version 2024.12.

Traitement OCR optimisé 2

ReadMultipleDocs :

Version optimisée (2025.2) : 20706,6 ms, 15,61% plus rapide que la version (2024.11).

Traitement OCR optimisé 3

  • Mémoire : 1,2 Go, 4,76% de moins que Legacy.
  • Version Pdfium : N'a pas réussi le benchmark

Traitement OCR optimisé 4

Applications du monde réel : Comment les entreprises en bénéficient

Légal et conformité : Numérisation plus rapide des documents

Un cabinet d'avocats numérisant des contrats légaux rencontrait auparavant un traitement OCR lent lors de la gestion d'accords scannés multipages. Avec IronOCR 2025.2, ils peuvent désormais convertir les contrats en PDF consultables presque 50 % plus rapidement, rationalisant ainsi la recherche de dossiers et les vérifications de conformité.

Santé : Traitement efficace des dossiers médicaux

Les hôpitaux et cliniques traitent souvent de grandes numérisations TIFF de dossiers patients. Auparavant, convertir un document d'historique médical de 24 pages en PDF consultable prenait plus d'une minute. Désormais, avec une gestion de la mémoire et un traitement concurrent améliorés, cette tâche est réalisée en seulement 32 secondes, permettant un accès plus rapide aux données critiques des patients.

Finance et audit : Gestion des rapports en vrac

Les cabinets comptables scannant des centaines de pages de rapports financiers avaient besoin d'une solution pour garder les tailles de fichiers gérables tout en assurant la consultabilité du texte. Avec le rendu affiné d'IronOCR, ils peuvent désormais traiter plus efficacement les numérisations de plusieurs documents, réduisant à la fois le temps de traitement et les tailles finales des fichiers.

Recherche et archives : Préservation des documents historiques

Les archivistes travaillant avec des articles de recherche scannés et des documents historiques nécessitent une reconnaissance de texte très précise tout en gardant les fichiers légers pour le stockage. Les dernières optimisations leur permettent de gérer les conversions de documents à grande échelle avec des charges de traitement significativement réduites.


L'évolution des PDF consultables : Un processus, pas seulement un bond en avant

L'optimisation n'est pas un bond en avant singulier, c'est un processus étape par étape façonné par les défis du monde réel.

  1. 2024.11 :**** Nous avons introduit une réduction de la taille des fichiers PDF consultables, mais nous avons rencontré des limitations de performance.
  2. 2024.12 :**** Les améliorations apportées au rendu ont permis de réduire la taille des fichiers PDF, mais ont révélé des problèmes de vitesse et de mémoire avec les fichiers TIFF volumineux.
  3. 2025.1 :**** Résolution du premier goulot d'étranglement dans le traitement de la rotation des pages, améliorant le temps de traitement de 10 % .
  4. 2025.2 : Optimisations complètes offrant une amélioration de performance de 49%, une plus grande efficacité de la mémoire, et une gestion plus fluide des grands PDF consultables.

Chaque mise à jour s'appuie sur les leçons de la précédente, résultant en un moteur OCR plus rapide, plus efficace, et prêt pour les charges de travail exigeantes.


Découvrez la puissance de la dernière mise à jour IronOCR

Si votre entreprise dépend d'un traitement OCR rapide, efficace et précis, cette mise à jour IronOCR 2025.2 fournit la vitesse et l'optimisation nécessaires.

Essayez la clé d'essai gratuite pendant 30 jours et découvrez le processus !

Articles connexes

Key in blue circle

Obtenez votre clé d'essai de 30 jours instantanément.

Your trial license will be sent to your email address

Aucune restriction. 100 % débloqué. Pas de carte bancaire.

bullet_checkedAucune carte de crédit ou création de compte requiseAucune restriction. 100 % débloqué. Pas de carte bancaire.
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried IronPDF
Obtenez Votre Consultation sans Engagement
Remplissez le formulaire ci-dessous ou envoyez un email à sales@ironsoftware.com
Vos informations seront toujours gardées confidentielles.
De confiance par des millions d'ingénieurs dans le monde entier
Logos des clients d'Iron Software
Obtenez votre clé d'essai 30 jours gratuitement.
Aucune carte de crédit ou création de compte requise