IRONSOFTWAREHOME

Amélioration des résultats OCR insatisfaisants

Curtis Chau
Curtis Chau
Updated: 29 juin 2026

La qualité de l'OCR dépend fortement de l'entrée. Une configuration, un filtre ou un réglage qui lit proprement un document peut échouer sur un autre, vous laissant avec un texte corrompu ou incomplet. Lorsque la lecture standard déçoit, le paquet IronOcr.Extensions.AdvancedScan comble généralement l'écart de précision.

La différence réside dans le moteur. IronOCR standard fonctionne sur le moteur Tesseract, tandis que IronOcr.Extensions.AdvancedScan est alimenté par PaddleOCR et ajoute des capacités d'apprentissage automatique. Cela le rend bien adapté aux entrées bruyantes comme les captures d'écran, et aux sources structurées comme les passeports et les plaques d'immatriculation.

Le package expose des méthodes de lecture spécialement conçues pour ces cas :

Solution

1. Commencez avec ReadDocumentAdvanced() et EnhanceResolution()

Avant de recourir à toute autre configuration, associez la méthode ReadDocumentAdvanced() avec le filtre de prétraitement EnhanceResolution(). Cette combinaison résout la plupart des problèmes de précision rencontrés par les utilisateurs avec la lecture standard.

Appliquez le filtre sur le OcrInput, puis passez cette même entrée à ReadDocumentAdvanced() :

var ocr = new IronTesseract();
using var input = new OcrInput();
input.LoadPdf("document.pdf");
// Upscale and sharpen low-resolution input before reading
input.EnhanceResolution();
var result = ocr.ReadDocumentAdvanced(input);
Console.WriteLine(result.Text);
C#

ReadDocumentAdvanced() exécute le moteur d'apprentissage automatique PaddleOCR pour analyser des documents riches en texte et sensibles à la mise en page, tandis que EnhanceResolution() améliore et affine les entrées basse résolution avant la lecture. La basse résolution est une cause fréquente de mauvais résultats, donc cette étape de pré-traitement est souvent aussi importante que le changement de moteur.

2. Ciblez x64 sur le .NET Framework

Configurez les projets .NET Framework pour qu'ils se compilent en x64. AdvancedScan nécessite une quantité importante de mémoire, et l'exécuter sous une autre architecture peut déclencher des erreurs d'exécution. Consultez le guide Advanced Scan on .NET Framework pour la configuration complète.

Limitations

AdvancedScan offre une grande précision, mais quelques contraintes s'appliquent aujourd'hui :

  • Moins de fonctionnalités de résultats : Les objets de résultat AdvancedScan exposent moins de propriétés que l'objet standard OcrResult.
  • Types de retour différents : chaque méthode de lecture renvoie un type d'objet de résultat différent, consultez la Référence API pour les détails de celui que vous appelez.
  • Pas de PDF consultables : la création de PDF consultables à partir de la sortie AdvancedScan n'est pas encore prise en charge, bien que la fonctionnalité soit en développement.
  • Langues limitées : le package prend actuellement en charge l'anglais, le chinois, le japonais, le coréen et les alphabets latins.
Veuillez noter: La sortie PDF consultable n'est pas disponible pour le moment avec les lectures AdvancedScan. Si vous dépendez de cette fonctionnalité, restez sur le chemin de lecture standard d'IronOCR.
Curtis Chau
Rédacteur technique

Curtis Chau détient un baccalauréat en informatique (Université de Carleton) et se spécialise dans le développement front-end avec expertise en Node.js, TypeScript, JavaScript et React. Passionné par la création d'interfaces utilisateur intuitives et esthétiquement plaisantes, Curtis aime travailler avec des frameworks modernes et créer des manuels bien structurés et visuellement attrayants.

...
Lire la suite

Prêt à commencer?

Nuget Downloads 6,236,385Version :2026.9vient de sortir

Obtenez votre clé d'essai 30 jours gratuitement.
Aucune carte de crédit ou création de compte requise
Bibliothèque C# NuGet pour PDF
Installer avec NuGet

Version : 2026.9

PM > Install-Package IronOcr
nuget.org/packages/IronOcr/
  1. Dans l'explorateur de solutions, faites un clic droit sur Références, Gestion des packages NuGet
  2. Sélectionnez Parcourir et cherchez "IronOCR"
  3. Sélectionnez le package et installez
C# PDF DLL
Télécharger DLL

Version : 2026.9

ou téléchargez le programme d'installation Windows ici.

  1. Téléchargez et décompressez IronOCR à un emplacement tel que ~/Libs dans votre répertoire du projet
  2. Dans l'Explorateur de Solutions de Visual Studio, faites un clic droit sur Références. Sélectionnez Parcourir, "IronOCR.dll"

Licences à partir de $999

Vous avez une question ? Contactez notre équipe de développement.

Key in blue circle

Obtenez votre clé d'essai de 30 jours instantanément.

Your trial license will be sent to your email address

Aucune restriction. 100 % débloqué. Pas de carte bancaire.

bullet_checkedAucune carte de crédit ou création de compte requiseAucune restriction. 100 % débloqué. Pas de carte bancaire.
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried IronPDF
Obtenez Votre Consultation sans Engagement
Remplissez le formulaire ci-dessous ou envoyez un email à sales@ironsoftware.com
Vos informations seront toujours gardées confidentielles.
De confiance par des millions d'ingénieurs dans le monde entier
Logos des clients d'Iron Software
Obtenez votre clé d'essai 30 jours gratuitement.
Aucune carte de crédit ou création de compte requise