IRONSOFTWAREHOME
ドキュメント内のテーブルを読む
using IronOcr;
using System.Linq;

// Instantiate OCR engine
var ocr = new IronTesseract();

using var input = new OcrInput();
input.LoadPdf("table.pdf");

// Perform OCR
var result = ocr.ReadDocumentAdvanced(input);

var cellList = result.Tables.First().CellInfos;
Imports IronOcr
Imports System.Linq

' Instantiate OCR engine
Dim ocr = New IronTesseract()

Using input = New OcrInput()
    input.LoadPdf("table.pdf")

    ' Perform OCR
    Dim result = ocr.ReadDocumentAdvanced(input)

    Dim cellList = result.Tables.First().CellInfos
End Using
NuGet Download
PM > Install-Package IronOcr
ドキュメント内のテーブルを読む

ドキュメント内のテーブルを読む

このコード例は、IronTesseract OCRエンジンを使用して、PDFドキュメントからテキストと表データを抽出する方法を示しています。

  1. IronTesseract OCRエンジンのインスタンスが作成されます。
  2. LoadPdfメソッドを使用して読み込まれます。
  3. OcrResultオブジェクトを返します。
  4. ドキュメント内で見つかった最初のテーブルはCellInfosで抽出されます。
  5. 現在、セルデータのリスト(cellList)は、テーブルのセルを含んでおり、テキスト内容およびその他の詳細(例:セルの位置、サイズ)を含んでいます。
  6. この方法は、PDF から表などの構造化データを抽出し、各表セル内のテキストにプログラムでアクセスして処理するのに便利です。
IronOCR を使用して PDF 内の表を読み取る方法を説明します。
GitHubで見る

準備はできましたか?

Nuget Downloads 6,236,385バージョン:2026.9リリースされたばかり

Key in blue circle

無料の30日間トライアルキーをすぐに入手してください。

Your trial license will be sent to your email address

制限なし。100% ロック解除済み。クレジットカード不要。

bullet_checkedクレジットカードやアカウントの作成は不要です。制限なし。100% ロック解除済み。クレジットカード不要。
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried IronPDF
義務のない相談を受ける
下記のフォームを記入するか、sales@ironsoftware.comにメールしてください。
あなたの詳細は常に守秘されます。
世界中の数百万人のエンジニアから信頼されています。
ライセンスはより安く
あなたの無料30日間の試用キーをすぐに入手。
クレジットカードやアカウントの作成は不要です。