大きなPDFファイルで英語高速モデルを二次言語にするとOCRが停止する
IronOCRは、大きなPDFファイルの処理中、二次言語としてOcrLanguage.EnglishFastを追加すると停止することがあります。 例外はスローされず、実行は再開されないため、リクエストが永遠に実行され続けるように見えます。
Execution stops at the ocr.Read() call. No exception is thrown and no error is logged.
この停止は、Windowsで二次言語リストにあるEnglishFastモデルによって引き起こされます。 当社のテストでは、IronOCR 2026.3.3を通じて再現されました。 修正されたバージョンが公開されるまで、その範囲内のリリースは影響を受ける可能性があると考えてください。 その他の二次言語に対するEnglishFastの順序変更は効果がありません。
解決策
1. 二次言語の設定を見つける
OCR設定内でAddSecondaryLanguageの呼び出しを探します。
// This line causes the hang on large PDFs
ocr.AddSecondaryLanguage(OcrLanguage.EnglishFast);
// This line causes the hang on large PDFs
ocr.AddSecondaryLanguage(OcrLanguage.EnglishFast);
' This line causes the hang on large PDFs
ocr.AddSecondaryLanguage(OcrLanguage.EnglishFast)
2. 英語高速モデルを削除して標準英語を維持する
問題のある呼び出しを削除するかコメントアウトしてください。 英語認識の品質を維持するために、OcrLanguage.Englishを主言語として設定し、他の二次言語をそのままにしてください。それらは影響を受けません。
// ocr.AddSecondaryLanguage(OcrLanguage.EnglishFast);
var ocr = new IronTesseract
{
Language = OcrLanguage.English
};
ocr.AddSecondaryLanguage(OcrLanguage.Hindi);
ocr.AddSecondaryLanguage(OcrLanguage.Marathi);
// ocr.AddSecondaryLanguage(OcrLanguage.EnglishFast);
var ocr = new IronTesseract
{
Language = OcrLanguage.English
};
ocr.AddSecondaryLanguage(OcrLanguage.Hindi);
ocr.AddSecondaryLanguage(OcrLanguage.Marathi);
Imports IronOcr
Dim ocr As New IronTesseract With {
.Language = OcrLanguage.English
}
ocr.AddSecondaryLanguage(OcrLanguage.Hindi)
ocr.AddSecondaryLanguage(OcrLanguage.Marathi)
OcrLanguage.Englishを主言語として維持することで、英語テキストが多い文書に対する対応が可能です。
3. 影響を受けたPDFを再実行する
ドキュメントを再度処理してください。 今度は、すべてのページを止まることなく完了するはずです。

