Iron Tesseract OCR w pelni wspiera niestandardowe lub pobrane jezyki i czcionki zgodnie z formatem pliku Tesseract .traineddata (wersja 4 lub wyzej). Pliki tego typu można często znaleźć na GitHub.com.
Jeśli chcesz szkolić własne wsparcie dla niestandardowych czcionek lub pakiet językowy, zalecamy przeczytanie naszego samouczka na temat tworzenia niestandardowych pakietów językowych Tesseract.
Jak korzystać z Tesseract Languages do OCR
- Zainstaluj bibliotekę OCR, aby wybrać opcje językowe Tesseract.
- Podaj niestandardowy plik językowy, korzystając z
opcji UseCustomTesseractLanguageFile. - Utwórz obiekt
OcrInput,używając ścieżki do obrazu jako parametru. - Przekaż obiekt
OcrInputdo metodyRead,aby odczytać tekst w języku.