# Han Simplified Alphabet OCR in C# and .NET
[126 Weitere Sprachen](/csharp/ocr/languages/)
IronOCR ist eine C#-Softwarekomponente, die .NET-Entwicklern ermöglicht, Text aus Bildern und PDF-Dokumenten in 126 Sprachen, einschließlich des Han Vereinfachten Alphabets, zu lesen.
Es ist eine erweiterte Abspaltung von Tesseract, die exklusiv für .NET-Entwickler entwickelt wurde und regelmäßig andere Tesseract-Engines sowohl in Bezug auf Geschwindigkeit als auch Genauigkeit übertrifft.
## Inhalt von IronOcr.Languages.Han
Dieses Paket enthält 400 OCR-Sprachen for .NET:
* HanSimplifiedAlphabet
* HanSimplifiedAlphabetBest
* HanSimplifiedAlphabetFast
* HanSimplifiedVerticalAlphabet
* HanSimplifiedVerticalAlphabetBest
* HanSimplifiedVerticalAlphabetFast
* HanTraditionalAlphabet
* HanTraditionalAlphabetBest
* HanTraditionalAlphabetFast
* HanTraditionalVerticalAlphabet
* HanTraditionalVerticalAlphabetBest
* HanTraditionalVerticalAlphabetFast
## Download
Han Vereinfachtes Alphabet Sprachpaket [Samhan]
* Download as <a href="javascript:window.open("/csharp/ocr/packages/language-packs/Han.ocrdata.zip"">Zip</a> <i class="fas fa-download"></i>
* Installieren mit <a href="https://www.nuget.org/packages/IronOcr.Languages.Han/">NuGet</a> <i class="nuget-icon"></i>
## Installation
Das Erste, was wir tun müssen, ist, unser **Han Vereinfachtes Alphabet** OCR-Paket in Ihrem .NET-Projekt zu installieren.
Führen Sie den folgenden Befehl in der Paket-Manager-Konsole aus:
```shell
:InstallCmd Install-Package IronOcr.Languages.Han
```
## Beispielcode
Dieses C#-Codebeispiel liest Han Vereinfachtes Alphabet Text aus einem Bild oder PDF-Dokument.
```csharp
// Reference the IronOcr library
using IronOcr;
class Program
{
static void Main()
{
// Create an IronTesseract OCR engine
var Ocr = new IronTesseract();
// Load the Han language for OCR processing
Ocr.Language = OcrLanguage.Han;
// Using a 'using' statement for resource management
using (var Input = new OcrInput(@"images\Han.png"))
{
// Process the image to extract text
var Result = Ocr.Read(Input);
// Retrieve and display the extracted text
string AllText = Result.Text;
System.Console.WriteLine(AllText);
}
}
}
```
### Erklärung
- Wir beginnen damit, die IronOCR-Bibliothek zu referenzieren, um ihre OCR-Fähigkeiten zu nutzen.
- Eine Instanz von `IronTesseract` wird erstellt, um die Bild-/PDF-Dokumente zu verarbeiten.
- Die Sprache für den OCR-Prozess wird mit `Han` unter Verwendung von `Ocr.Language` festgelegt.
- Ein Bild wird mit `OcrInput` geladen und durch den Aufruf von `Ocr.Read()` verarbeitet.
- Das Ergebnis des OCR-Prozesses wird in `Result.Text` gespeichert, das den extrahierten Text aus dem Dokument enthält.
- Schließlich drucken wir den Text auf die Konsole.
Stellen Sie sicher, dass die richtigen `using`-Direktiven vorhanden sind und verwalten Sie Ressourcen effizient mit `using`-Anweisungen, insbesondere beim Umgang mit nicht verwalteten Ressourcen wie Dateistreams.
IronOCR ist eine C#-Softwarekomponente, die .NET-Entwicklern ermöglicht, Text aus Bildern und PDF-Dokumenten in 126 Sprachen, einschließlich des Han Vereinfachten Alphabets, zu lesen.
Es ist eine erweiterte Abspaltung von Tesseract, die exklusiv für .NET-Entwickler entwickelt wurde und regelmäßig andere Tesseract-Engines sowohl in Bezug auf Geschwindigkeit als auch Genauigkeit übertrifft.
Das Erste, was wir tun müssen, ist, unser Han Vereinfachtes Alphabet OCR-Paket in Ihrem .NET-Projekt zu installieren.
Führen Sie den folgenden Befehl in der Paket-Manager-Konsole aus:
PM > Install-Package IronOcr.Languages.Han
Install-Package IronOcr.Languages.Han
Beispielcode
Dieses C#-Codebeispiel liest Han Vereinfachtes Alphabet Text aus einem Bild oder PDF-Dokument.
// Reference the IronOcr libraryusing IronOcr;class Program{ static voidMain() { // Create an IronTesseract OCR engine varOcr = new IronTesseract(); // Load the Han language for OCR processingOcr.Language = OcrLanguage.Han; // Using a 'using' statement for resource management using (varInput = new OcrInput(@"images\Han.png")) { // Process the image to extract text varResult = Ocr.Read(Input); // Retrieve and display the extracted text stringAllText = Result.Text;System.Console.WriteLine(AllText); } }}
// Reference the IronOcr library
using IronOcr;
class Program
{
static void Main()
{
// Create an IronTesseract OCR engine
var Ocr = new IronTesseract();
// Load the Han language for OCR processing
Ocr.Language = OcrLanguage.Han;
// Using a 'using' statement for resource management
using (var Input = new OcrInput(@"images\Han.png"))
{
// Process the image to extract text
var Result = Ocr.Read(Input);
// Retrieve and display the extracted text
string AllText = Result.Text;
System.Console.WriteLine(AllText);
}
}
}
' Reference the IronOcr libraryImportsIronOcrModuleProgram Sub Main() ' Create an IronTesseract OCR engine DimOcrAs New IronTesseract() ' Load the Han language for OCR processingOcr.Language = OcrLanguage.Han ' Using a 'Using' statement for resource managementUsingInputAs New OcrInput("images\Han.png") ' Process the image to extract text DimResult = Ocr.Read(Input) ' Retrieve and display the extracted text DimAllTextAsString = Result.TextSystem.Console.WriteLine(AllText)EndUsing End SubEndModule
' Reference the IronOcr library
Imports IronOcr
Module Program
Sub Main()
' Create an IronTesseract OCR engine
Dim Ocr As New IronTesseract()
' Load the Han language for OCR processing
Ocr.Language = OcrLanguage.Han
' Using a 'Using' statement for resource management
Using Input As New OcrInput("images\Han.png")
' Process the image to extract text
Dim Result = Ocr.Read(Input)
' Retrieve and display the extracted text
Dim AllText As String = Result.Text
System.Console.WriteLine(AllText)
End Using
End Sub
End Module
Erklärung
Wir beginnen damit, die IronOCR-Bibliothek zu referenzieren, um ihre OCR-Fähigkeiten zu nutzen.
Eine Instanz von IronTesseract wird erstellt, um die Bild-/PDF-Dokumente zu verarbeiten.
Die Sprache für den OCR-Prozess wird mit Han unter Verwendung von Ocr.Language festgelegt.
Ein Bild wird mit OcrInput geladen und durch den Aufruf von Ocr.Read() verarbeitet.
Das Ergebnis des OCR-Prozesses wird in Result.Text gespeichert, das den extrahierten Text aus dem Dokument enthält.
Schließlich drucken wir den Text auf die Konsole.
Stellen Sie sicher, dass die richtigen using-Direktiven vorhanden sind und verwalten Sie Ressourcen effizient mit using-Anweisungen, insbesondere beim Umgang mit nicht verwalteten Ressourcen wie Dateistreams.
Curtis Chau hat einen Bachelor-Abschluss in Informatik von der Carleton University und ist spezialisiert auf Frontend-Entwicklung mit Expertise in Node.js, TypeScript, JavaScript und React. Leidenschaftlich widmet er sich der Erstellung intuitiver und ästhetisch ansprechender Benutzerschnittstellen und arbeitet gerne mit modernen Frameworks sowie der Erstellung gut strukturierter, optisch ansprechender Handbücher.