Dokümandaki Tabloyu Okuma
Bu kod örneği, bir PDF belgesinden metin ve tablo verilerini çıkarmak için IronTesseract OCR motorunun nasıl kullanılacağını göstermektedir.
IronTesseractOCR motorunun bir örneği oluşturulur.- Bir
OcrInputnesnesi başlatılır ve bir PDF dosyası (table.pdf)LoadPdfyöntemi kullanılarak yüklenir. - OCR motoru, belgeleri
ReadDocumentAdvancedyöntemi ile işler ve daha ayrıntılı birOcrResultnesnesi döndürür. - Belgedeki bulunan ilk tabloya
result.Tables.First()kullanılarak erişilir ve o tabloya ait hücre bilgileriCellInfosile çıkarılır. - Hücre verilerinin listesi (
cellList) şimdi tablonun hücrelerini, metin içeriği ve diğer detayları (ör., hücre konumu, boyutu) içermektedir. - Bu yöntem, her tablo hücresindeki metnin programlı olarak erişilip işlenmesine olanak tanıyan yapılandırılmış verileri, örneğin tabloları PDF'lerden çıkarmak için yararlıdır.
IronOCR ile PDF'lerdeki Tabloları Okumanın Yollarını Keşfedin.

