C#と.NETでタイ語アルファベットOCR
このドキュメントの他のバージョン:
IronOCR は、.NET コーダーがタイ語アルファベットを含む 126 の言語で画像や PDF ドキュメントからテキストを読み取ることを可能にする C# ソフトウェア コンポーネントです。
これはTesseractの高度なフォークであり、.NET開発者専用に構築され、速度と精度の両方で他のTesseractエンジンを定期的に上回ります。
IronOcr.Languages.Thai の内容
このパッケージには、.NET 用の 96 個の OCR 言語が含まれています。
- タイ語
- タイ語Best
- タイ語Fast
- タイ文字
- タイ文字Best
- タイ語アルファベット高速
ダウンロード
タイ語アルファベット言語パック[タイ語]
インストール
最初に、タイ語アルファベットOCR パッケージを .NET プロジェクトにインストールする必要があります。
Code Example
この C# コード例は、画像または PDF ドキュメントからタイ語アルファベットのテキストを読み取ります。
// Ensure you have installed the IronOcr.Languages.Thai package via NuGet.
// Import the IronOcr namespace to work with IronOCR classes.
using IronOcr;
class ThaiOcrExample
{
static void Main()
{
// Create a new instance of IronTesseract for OCR processing
var ocr = new IronTesseract();
// Set the language to Thai for Optical Character Recognition
ocr.Language = OcrLanguage.Thai;
// Using the 'using' statement ensures that resources are properly disposed.
using (var input = new OcrInput(@"images\Thai.png"))
{
// Perform OCR to read the text from the input image
var result = ocr.Read(input);
// Retrieve and store all recognized text from the image
string allText = result.Text;
// Optionally, you can output the text to console or log it as needed
System.Console.WriteLine(allText);
}
}
}
この例では、Thai.pngという名前の画像からタイ語テキストを読み取ります。 ファイル パスを実際の画像の場所に置き換えてください。 OCRの言語は、認識のためにタイ語のパッケージを指定するOcrLanguage.Thaiを使用してタイ語に設定されています。

Curtis Chauは、カールトン大学でコンピュータサイエンスの学士号を取得し、Node.js、TypeScript、JavaScript、およびReactに精通したフロントエンド開発を専門としています。直感的で美しいユーザーインターフェースを作成することに情熱を持ち、Curtisは現代のフレームワークを用いた開発や、構造の良い視覚的に魅力的なマニュアルの作成を楽しんでいます。