IRONSOFTWAREHOME
在文档中读取表格
using IronOcr;
using System.Linq;

// Instantiate OCR engine
var ocr = new IronTesseract();

using var input = new OcrInput();
input.LoadPdf("table.pdf");

// Perform OCR
var result = ocr.ReadDocumentAdvanced(input);

var cellList = result.Tables.First().CellInfos;
Imports IronOcr
Imports System.Linq

' Instantiate OCR engine
Dim ocr = New IronTesseract()

Using input = New OcrInput()
    input.LoadPdf("table.pdf")

    ' Perform OCR
    Dim result = ocr.ReadDocumentAdvanced(input)

    Dim cellList = result.Tables.First().CellInfos
End Using
NuGet Download
PM > Install-Package IronOcr
在文档中读取表格

在文档中读取表格

该代码示例演示了如何使用 IronTesseract OCR 引擎从PDF文档中提取文本和表格数据。

  1. 创建 IronTesseract OCR 引擎的实例。
  2. 初始化一个 OcrInput 对象,并使用 LoadPdf 方法加载一个PDF文件(table.pdf)。
  3. OCR 引擎使用 ReadDocumentAdvanced 方法处理文档,返回更详细的 OcrResult 对象。
  4. 使用 result.Tables.First() 访问文档中找到的第一个表格,并使用 CellInfos 提取该表格的单元信息。
  5. 现在 cellList 中的单元数据列表包含了表格的单元,包括文本内容和其他详细信息(例如,单元位置、大小)。
  6. 此方法可用于从 PDF 中提取结构化数据(如表格),允许以编程方式访问和处理每个表格单元格中的文本。
探索如何使用 IronOCR 读取 PDF 中的表格。
在 GitHub 上查看

准备开始了吗?

Nuget Downloads 6,236,385版本:2026.9刚刚发布

Key in blue circle

立即获取免费的 30 天试用版密钥

Your trial license will be sent to your email address

无任何限制。100% 解锁。无需信用卡。

bullet_checked无需信用卡或创建账户无任何限制。100% 解锁。无需信用卡。
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried IronPDF
获取您的无义务咨询
填写下面的表格或通过sales@ironsoftware.com
您的资料将始终保密。
深受全球数百万工程师信赖
Iron Software 的客户徽标
立即获取您的免费30 天试用密钥
无需信用卡或创建账户