IronOCR'da Beklenmedik Beyaz Alanlar
Çıkarılan metin bazen karakterler arasında ekstra beyaz boşluklar içerir, kaynak belge temiz görünse bile. Genellikle suçlu karakter genişliğinde ve periyodundaki değişkliklerdir, bu durum genellikle giriş yazı tipine bağlıdır, ve sadece görüntü filtreleri nadiren bunu düzeltir.

Aşağıdaki yaklaşımlar, ekstra boşlukları önlemede etkili olmuştur.
Çözüm
1. OCR Dostu Bir Yazı Tipine Geçin
Belgeyi mümkünse Roboto ile renderlayın veya sağlayın. Bu, temiz, modern bir yazı tipidir ve motor, Arial gibi yazı tiplerine göre daha az alakasız boşluk üretir.
2. ReadDocumentAdvanced() Kullan
Belgeyi standart okuma yöntemi yerine ReadDocumentAdvanced() ile okuyun. Bu size OCR süreci üzerinde daha fazla kontrol sunar ve karmaşık metin düzenlerini daha iyi işler.
3. OcrLanguage.EnglishBest Ayarla
Motoru OcrLanguage.EnglishBest modele yönlendirin. Bu gelişmiş dil modeli, standart İngilizce seçeneğinden daha doğrudur ve yanlış okunan boşlukları azaltır.
4. Özel Bir Yazı Tipi Eğitin
Girdi olarak alışılmadık veya standart olmayan bir yazı tipi kullanıldığında, varsayılan ayarlar mücadele edebilir ve boşluklar ekleyebilir. Özel bir yazı tipinin eğitilmesi, motorun o belirli yazı tipini tanımasına öğretir, bu da tanımayı önemli ölçüde iyileştirir. Tam iş akışını görmek için OCR özel yazı tipi eğitimi kılavuzuna bakın.
Bu ayarlar uygulandığında, çıkarılan metinler artık yanlış boşluklar içermemektedir:


