Dokümandaki Tabloyu Okuma

Bu kod örneği, bir PDF belgesinden metin ve tablo verilerini çıkarmak için IronTesseract OCR motorunun nasıl kullanılacağını göstermektedir.

  1. IronTesseract OCR motorunun bir örneği oluşturulur.
  2. Bir OcrInput nesnesi başlatılır ve bir PDF dosyası (table.pdf) LoadPdf yöntemi kullanılarak yüklenir.
  3. OCR motoru, belgeleri ReadDocumentAdvanced yöntemi ile işler ve daha ayrıntılı bir OcrResult nesnesi döndürür.
  4. Belgedeki bulunan ilk tabloya result.Tables.First() kullanılarak erişilir ve o tabloya ait hücre bilgileri CellInfos ile çıkarılır.
  5. Hücre verilerinin listesi (cellList) şimdi tablonun hücrelerini, metin içeriği ve diğer detayları (ör., hücre konumu, boyutu) içermektedir.
  6. Bu yöntem, her tablo hücresindeki metnin programlı olarak erişilip işlenmesine olanak tanıyan yapılandırılmış verileri, örneğin tabloları PDF'lerden çıkarmak için yararlıdır.

IronOCR ile PDF'lerdeki Tabloları Okumanın Yollarını Keşfedin.

Başlamaya Hazır mısınız?
Nuget İndirmeler 6,151,372 | Sürüm: 2026.7 yeni yayınlandı
Still Scrolling Icon

Hâlâ Kaydırıyor Musunuz?

Hızlıca kanıt ister misiniz? PM > Install-Package IronOcr
örnek çalıştır görüntünüzün aranabilir metin haline gelmesini izleyin.