English OCR in C# and .NET
Curtis Chau
Updated: 2026年4月8日
IronOCR是一个C#软件组件,允许.NET编码人员从包含英语在内的126种语言的图像和PDF文档中读取文本。
它是 Tesseract 的一个高级分支,专为 .NET 开发人员构建,在速度和准确性方面通常优于其他 Tesseract 引擎。
IronOcr.Languages.English的内容
此软件包包含 64 种适用于 .NET 的 OCR 语言:
下载
英语语言包 [现代英语]
- 下载为 Zip
代码示例
此C#代码示例从图像或PDF文档中读取英语文本。
// Import the IronOcr namespace
using IronOcr;
class Program
{
static void Main()
{
// Initialize the IronTesseract OCR engine
var Ocr = new IronTesseract();
// Set the language to English
Ocr.Language = OcrLanguage.English;
// Define the input source as an image file
using (var Input = new OcrInput(@"images\English.png"))
{
// Perform OCR to read the text from the input
var Result = Ocr.Read(Input);
// Get all the recognized text
var AllText = Result.Text;
// Output the recognized text
Console.WriteLine(AllText);
}
}
}
C#
- 请确保您已安装 IronOCR 软件包和相应的语言包。
- 此示例初始化OCR引擎,将其设置为处理英语,从输入图像中读取文本,并输出识别的文本。

技术作家
Curtis Chau 拥有卡尔顿大学的计算机科学学士学位,专注于前端开发,精通 Node.js、TypeScript、JavaScript 和 React。他热衷于打造直观且美观的用户界面,喜欢使用现代框架并创建结构良好、视觉吸引力强的手册。
...
阅读更多