IRONSOFTWAREHOME

Кыргыз OCR C# жана .NET

Curtis Chau
Curtis Chau
Updated: 2026년 5월 9일
Бул документтин башка версиялары:

IronOCR .NET кодерлерине сүрөттөрдөн жана PDF документтеринен 126 тилде, анын ичинде кыргыз тилинде текстти окууга мүмкүнчүлүк берген C# программалык компоненти.

Бул .NET иштеп чыгуучулары үчүн гана курулган жана ылдамдыгы менен тактыгы боюнча башка Tesseract кыймылдаткычтарынан үзгүлтүксүз ашып турган Tesseractтын өркүндөтүлгөн айрысы.

Мазмуну IronOCR.Тилдер.Кыргызча

Бул пакетте .NET үчүн 43 OCR тил бар:

  • Кыргызча
  • KyrgyzBest
  • KyrgyzFast

Жүктөө

Кыргыз тилинин пакети [Кыргызча]
* Download as Zip
* Install with as NuGet

Орнотуу

Сиздин .NET долбоорго Кыргызстан OCR топтомун орнотуу керек.

PM> Install-Package IronOcr.Languages.Kyrgyz

Коддун мисалы

Бул C# кодунун мисалы сүрөттөгү же PDF документтеги кыргызча текстти окуйт:

// PM> Install-Package IronOcr.Languages.Kyrgyz
using IronOcr;

var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Kyrgyz;

using (var Input = new OcrInput(@"images\Kyrgyz.png"))
{
    var Result = Ocr.Read(Input);
    // Read the text using OCR from the image
    var AllText = Result.Text;
    // Extracted text from the image
}

Эмне үчүн IronOCRди тандоо керек?

IronOCR - орнотууга оңой, толук жана жакшы документтелген .NET программалык китепканасы.

99,8% + OCR тактыгына жетүү үчүн IronOCR тандаңыз, эч кандай тышкы веб-кызматтарды колдонбостон, туруктуу акы төлөбөй же интернет аркылуу купуя документтерди жөнөтпөңүз.

Эмне үчүн C# иштеп чыгуучулары IronOCRди Vanilla Tesseract ордуна тандашат:

  • Бир DLL же NuGet катары орнотуңуз
  • Кутудан тышкары Tesseract 5, 4 жана 3 кыймылдаткычтарын камтыйт.
  • Тактыгы 99,8% кадимки Tesseractтен ашып түшөт.
  • Жалындуу ылдамдык жана MultiThreading
  • MVC, WebApp, Desktop, Console & Server Application шайкеш
  • Exes же C++ коду иштей албайт
  • Толугу менен PDF OCR колдоосу
  • OCR жүргүзүү үчүн дээрлик бардык сүрөт файлдары же PDF
  • Толугу менен .NET Core, Standard жана FrameWork колдоосу
  • Windows, Mac, Linux, Azure, Docker, Lambda, AWS орнотуу
  • Штрих коддорун жана QR коддорун окуу
  • OCRди XHTML форматында экспорттоо
  • Издөөгө боло турган PDF документтерине OCR экспорту
  • Multithreading колдоо
  • 126 эл аралык тилдин бардыгы NuGet же OcrData файлдары аркылуу башкарылат
  • Сүрөттөрдү, координаттарды, статистиканы жана шрифттерди бөлүп алыңыз. Тек гана текст эмес.
  • Tesseract OCRди коммерциялык жана менчик тиркемелердин ичинде бөлүштүрүү үчүн колдонсо болот.

Темир OCR чыныгы дүйнөдөгү сүрөттөр жана фотосүрөттөр сыяктуу жеткилеңсиз документтер менен иштөөдө же санариптик ызы-чуу же кемчиликтер болушу мүмкүн болгон төмөн чечилиштүү сканерлер менен иштөөдө жаркырайт.

.NET платформасы үчүн башка акысыз OCR китепканалары, мисалы, .NET Tesseract API жана веб кызматтары, бул чыныгы дүйнөдө колдонуу учурларында анчалык жакшы иштебейт.

Tesseract 5 менен OCR - C# менен коддоону баштаңыз

Төмөндөгү код үлгүсү C# же VB .NET аркылуу сүрөттөн текстти окуунун оңой экендигин көрсөтөт.

OneLiner

string Text = new IronTesseract().Read(@"img\Screenshot.png").Text;
// Simple one-liner to read text from an image

Configurable Hello World

// PM> Install-Package IronOcr.Languages.Kyrgyz
using IronOcr;

var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Kyrgyz;

using (var Input = new OcrInput())
{
    Input.AddImage("images/sample.jpeg");
    //... сиз каалаган сандагы сүрөттөрдү кошо аласыз (you can add as many images as needed)

    var Result = Ocr.Read(Input);
    // Outputs the read text to the console
    Console.WriteLine(Result.Text);
}

C# PDF OCR

Ушул эле ыкманы ар кандай PDF документтен текст чыгарып алуу үчүн колдонсо болот.

using IronOcr;

var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Kyrgyz;

using (var input = new OcrInput())
{
    input.AddPdf("example.pdf", "password");
    // Add PDF and decrypt if necessary

    var Result = Ocr.Read(input);
    // Outputs the content read from the PDF
    Console.WriteLine(Result.Text);
    Console.WriteLine($"{Result.Pages.Count()} Pages");
    // PDFтин ар бир барагына 1 барак
}

MultiPage TIFF үчүн OCR

OCR Reading TIFF файл форматы, анын ичинде бир нече барактык документтер. TIFF түздөн-түз изделүүчү текст менен PDF файлга айландырылышы мүмкүн.

using IronOcr;

var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Kyrgyz;

using (var Input = new OcrInput())
{
    Input.AddMultiFrameTiff("multi-frame.tiff");
    // Processes multi-page TIFF

    var Result = Ocr.Read(Input);
    // Outputs the text from the TIFF
    Console.WriteLine(Result.Text);
}

Штрих коддору жана QR

Темир OCRдин уникалдуу өзгөчөлүгү - текстти сканерлеп жатканда документтердеги штрих коддорду жана QR коддорду окуй алат. OcrResult.OcrBarcode классынын мисалдары иштеп чыгуучуга ар бир сканерленген штрих-код жөнүндө кеңири маалымат берет.

using IronOcr;

var Ocr = new IronTesseract();
Ocr.Configuration.ReadBarCodes = true;

using (var input = new OcrInput())
{
    input.AddImage("img/Barcode.png");
    // Read barcodes from images

    var Result = Ocr.Read(input);
    foreach (var Barcode in Result.Barcodes)
    {
        Console.WriteLine(Barcode.Value);
        // түрү жана жайгашкан жер касиеттери да ачыкка чыккан
    }
}

Сүрөттөрдүн белгилүү бир аймактары боюнча OCR

Темир OCRди сканерлөө жана окуу ыкмаларынын бардыгы текстти барактын же беттин кайсы бөлүгүнөн окууну каалай тургандыгыбызды көрсөтөт. Бул стандартташтырылган формаларды карап жатканда абдан пайдалуу жана бир топ убакытты үнөмдөп, натыйжалуулугун жогорулатат.

Эгин өсүмдүктөрүн пайдалануу үчүн, биз System.Drawing.Rectangle объектисин колдоно алышыбыз үчүн, System.Drawing тутумуна шилтеме керек.

using IronOcr;
using System.Drawing; // Required for working with Rectangle

var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Kyrgyz;

using (var Input = new OcrInput())
{
    var ContentArea = new Rectangle() { X = 215, Y = 1250, Height = 280, Width = 1335 };
    // Specify the area to perform OCR in

    Input.Add("document.png", ContentArea);
    var Result = Ocr.Read(Input);
    // Outputs the text from the specified rectangle in the image
    Console.WriteLine(Result.Text);
}

Төмөн сапаттуу сканерлер үчүн OCR

IronOCR OcrInput классы кадимки Tesseract окуй албаган сканерлерди оңдой алат.

using IronOcr;

var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Kyrgyz;

using (var Input = new OcrInput(@"img\Potter.LowQuality.tiff"))
{
    Input.DeNoise(); // Sanitize noisy images
    Input.Deskew();  // Correct skewed images
    var Result = Ocr.Read(Input);
    // Outputs the text from the low-quality image
    Console.WriteLine(Result.Text);
}

OCR натыйжаларын Издөөчү PDF форматында экспорттоо

Көчүрүлө турган тексттик саптар менен PDF сүрөтү. Издөө системалары жана маалымат базалары тарабынан индекстелиши мүмкүн.

using IronOcr;

var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Kyrgyz;

using (var Input = new OcrInput())
{
    Input.Title = "Quarterly Report";
    Input.AddImage("image1.jpeg");
    Input.AddImage("image2.png");
    Input.AddImage("image3.gif");

    var Result = Ocr.Read(input);
    Result.SaveAsSearchablePdf("searchable.pdf");
    // Save OCR results as searchable PDF
}

Издөө үчүн PDF которууга TIFF

TIFF документин (же кандайдыр бир сүрөт файлдарынын тобун) түздөн-түз интранет, веб-сайт жана Google издөө системалары тарабынан индекстелиши мүмкүн болгон издөөгө боло турган PDF файлга которуңуз.

using IronOcr;

var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Kyrgyz;

using (var Input = new OcrInput())
{
    Input.AddMultiFrameTiff("example.tiff");
    var Result = Ocr.Read(Input).SaveAsSearchablePdf("searchable.pdf");
    // Converts TIFF to a searchable PDF
}

OCR натыйжаларын HTML форматында экспорттоо

OCR сүрөтүн XHTMLге которуу.

using IronOcr;

var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Kyrgyz;

using (var Input = new OcrInput())
{
    Input.Title = "Html Title";
    Input.AddImage("image1.jpeg");
    var Result = Ocr.Read(input);
    Result.SaveAsHocrFile("results.html");
    // Save OCR results as HTML
}

OCR сүрөтүн өркүндөтүү чыпкалары

IronOCR OcrInput объектилери үчүн OCR иштөөсүн жакшыртуу үчүн уникалдуу чыпкаларды берет.

Сүрөттү өркүндөтүү кодунун мисалы

OCR натыйжаларын мыкты жана тезирээк чыгаруу үчүн OCR киргизүү сүрөттөрүн сапаттуу кылат.

using IronOcr;

var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Kyrgyz;

using (var Input = new OcrInput(@"LowQuality.jpeg"))
{
    Input.DeNoise(); // Removes digital noise
    Input.Deskew();  // Corrects rotation and perspective

    var Result = Ocr.Read(Input);
    // Outputs the text after image enhancement
    Console.WriteLine(Result.Text);
}

OCR сүрөт чыпкаларынын тизмеси

IronOCR ичине орнотулган OCR иштөөсүн жогорулатуучу киргизүү чыпкаларына төмөнкүлөр кирет:

  • OcrInput.Rotate (эки градус) - Сүрөттөрдү сааттын жебеси боюнча бир нече градуска айландырат. Сааттын жебесине каршы терс сандарды колдонуңуз.
  • OcrInput.Binarize() - Бул сүрөт чыпкасы ар бир пикселди ак же кара түскө айландырат. Тексттин фон менен карама-каршы келишинин OCR көрсөткүчтөрүн жакшыртышы мүмкүн.
  • OcrInput.ToGrayScale() - Сүрөттөрдү боз түстөгү көлөкөгө айландыруу OCR тактыгын жакшыртат.
  • OcrInput.Contrast() - Контрастты автоматтык түрдө көбөйтөт. Бул чыпка күңүрт сканерлерде OCR ылдамдыгын жана тактыгын жакшыртат.
  • OcrInput.DeNoise() - Санарип ызы-чууну токтотуу. Бул чыпканы ызы-чуу болушу мүмкүн деп эсептеген учурларда гана колдонуу керек.
  • OcrInput.Invert() - Ар бир түстү тескери кылат. Мисалы, ак кара болуп калат, кара ак болуп калат.
  • OcrInput.Dilate() - Морфологиялык мүмкүндүктөрдү жакшыртуу. Сүрөттөгү объектилердин чек араларына пикселдерди кошот.
  • OcrInput.Erode() - Морфологиялык мүмкүндүктөрдү жакшыртуу, чек араларындагы пикселдерди жок кылат.
  • OcrInput.Deskew() - Сүрөттү айландырып, ал туура жол жана ортогоналдуу болот. Бул OCR үчүн абдан пайдалуу.
  • OcrInput.DeepCleanBackgroundNoise() - Катуу фондук ызы-чууну жок кылуу.
  • OcrInput.EnhanceResolution - Төмөн сапаттагы сүрөттөрдүн чечилишин жогорулатуу.

CleanBackgroundNoise. Бул бир аз убакытты талап кылган жөндөө; бирок, ал китепканага санариптик сүрөттүн ичиндеги санариптик ызы-чууну, кагаздын бырыштарын жана башка кемчиликтерди автоматтык түрдө тазалоого мүмкүнчүлүк берет, башкача айтканда, аны башка OCR китепканалары окуй албай калат.

EnhanceContrast - ийгиликтерди темир OCRтин тексттин карама-каршылыгын сүрөттүн фонунда автоматтык түрдө көбөйтүп, OCRдин тактыгын жогорулатып, иштешин жана ылдамдыгын жогорулатуу үчүн колдонулат.

EnhanceResolution - резолюциясы төмөн сүрөттөрдүн автоматтык түрдө аныкталуучу жана жогорулатуу, андан кийин тексттин бардыгын курчутуу.

Тил IronOCR 122 тилдик пакеттерди колдойт жана тилди жөндөө аркылуу OCR үчүн бир же бир нече тилди тандап алууда колдонулушу мүмкүн.

Стратегия IronOCR алты стратегияны колдойт. Документти тезирээк жана таптакыр так эмес сканерлөөнү тандашыбыз керек же жасалма интеллекттин каражаттары менен OCR текстинин тактыгын өркүндөтүү үчүн чечимдер менен алектенүүчү стратегияларды тандашыбыз мүмкүн.

ColorSpace - бул биз боз түстө же түстө окууну каалаган ишмерчиликтер үчүн белгиленет. Көпчүлүк учурда, боз шкала катары тандап алуу эң жакшы.

DetectWhiteTextOnDarkBackgrounds. Бул темир OCRди автоматтык түрдө негативге ылдамдык жана тактык менен натыйжалуу чечүү мүмкүнчүлүгүн берет.

InputImageType. Бул жараткычка OCRдин бүт документин же кандайдыр бир үзүндү же таркатма билишке даяр документти окуу керек экендигин көрсөтөт.

RotateAndStraighten - бул темир OCRди графикалык түзүлүштөргө каршы болдура турган уникалдуу жөндөмдүүлүктү берет.

ReadBarcodes - барактын текстин сканерлөө маалында кайталарда автоматтык штрих-коддорду окуйт, ал тек көздөй кошумча убакытты талап кылбайт.

Түс тереңдиги. Бул параметр түстүн тереңдигин аныктоо үчүн OCR китепканасы канча бит пикселге кармаларын аныктайт.

126 тил таңгактары

IronOCR 126 эл аралык тилди DLL форматында таратылган тил пакеттери аркылуу колдойт, аларды бул веб-сайттан , же NuGet Пакет Менеджеринен жүктөп алууга болот.

Тилдерге немис, француз, англис, кытай, жапон жана башка көптөгөн тилдер кирет. Паспорттук MRZ, MICR чектер, Финансылык маалыматтар, Мамлекеттик номурлар жана башка көптөгөн нерселер боюнча тилдик пакеттер бар. Сиз каалаган ".traineddata" Tesseract файлын, анын ичинде бир Өзүңүз жараткан файлдарды колдонсоңуз болот.

Тил мисалы

Башка OCR тилдерин колдонуу.

using IronOcr;
// PM> Install IronOcr.Languages.Arabic

var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Arabic;

using (var input = new OcrInput())
{
    input.AddImage("img/arabic.gif");
    // Керек болсо сүрөт чыпкаларын кошуңуз

    var Result = Ocr.Read(input);
    // Save Arabic text to file as it may not display correctly in Console
    Result.SaveAsTextFile("arabic.txt");
}

Көп тилдин мисалы

Бир эле учурда бир нече тилди колдонуп OCR жүргүзсө болот. Бул чындыгында англис тилиндеги метадайындарды жана Юникод документтериндеги URL даректерин алууга жардам берет.

using IronOcr;
// PM> Install IronOcr.Languages.ChineseSimplified

var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.ChineseSimplified;
Ocr.AddSecondaryLanguage(OcrLanguage.Kyrgyz);

using (var input = new OcrInput())
{
    input.Add("multi-language.pdf");
    // Extract text from multi-language PDF

    var Result = Ocr.Read(input);
    // Save the OCR results to a text file
    Result.SaveAsTextFile("results.txt");
}

Толук OCR натыйжалары объектилери

Темир OCR ар бир OCR операциясы үчүн OCR натыйжасы объектисин берет. Адатта, иштеп чыгуучулар сүрөттүн сканерленген текстин алуу үчүн ушул объекттин тексттик касиетин гана колдонушат. Бирок, OCR натыйжалары DOM буга караганда кыйла өнүккөн.

using IronOcr;
using System.Drawing; // Ассамблея маалымдамасын кошуу

var Ocr = new IronTesseract();
Ocr.Language = OcrLanguage.Kyrgyz;
Ocr.Configuration.EngineMode = TesseractEngineMode.TesseractAndLstm;
Ocr.Configuration.ReadBarCodes = true;

using (var Input = new OcrInput(@"images\sample.tiff"))
{
    var Result = Ocr.Read(Input);
    var Pages = Result.Pages;
    var Words = Pages[0].Words;
    var Barcodes = Result.Barcodes;
    // Массалык, кеңири API табуу үчүн бул жерден издеңиз:
    // - Барактар, Блоктор, Парафрафалар, Сызыктар, Сөздөр, Тексттер
    // - Сүрөттөрдү экспорттоо, Шрифттердин координаттары, Статистикалык маалыматтар
}

Performance

IronOCR коробкадан чыгып, сүрөттөрдү аткарууну же катуу өзгөртүүнү талап кылбайт.

Ылдамдык жалындап турат: IronOCR.2020 + 10 эсе ылдамыраак жана мурунку курууларга караганда 250% га аз ката кетирет.

Көбүрөөк билүү

OCR жөнүндө C#, VB, F# же башка .NET тилдеринде көбүрөөк билүү үчүн, темир OCRди кантип колдонсо болоору жөнүндө чыныгы мисалдарды келтирген жамаатыбыздын окуу куралдарын окуп чыгыңыз жана андан мыкты нерселерди алуунун нюанстарын көрсөтүңүз. бул китепкана.

.NET иштеп чыгуучулары үчүн толук объект маалымдамасы да бар.

Curtis Chau
기술 문서 작성자

커티스 차우는 칼턴 대학교에서 컴퓨터 과학 학사 학위를 취득했으며, Node.js, TypeScript, JavaScript, React를 전문으로 하는 프론트엔드 개발자입니다. 직관적이고 미적으로 뛰어난 사용자 인터페이스를 만드는 데 열정을 가진 그는 최신 프레임워크를 활용하고, 잘 구성되고 시각적으로 매력적인 매뉴얼을 제작하는 것을 즐깁니다.

...
더 읽어보기

시작할 준비 되셨나요?

Nuget Downloads 6,236,385버전:2026.9방금 출시

지금 바로 30일 무료 체험판 키를 받으세요.
신용카드나 계정 생성은 필요하지 않습니다.
PDF용 C# NuGet 라이브러리
NuGet을 사용하여 설치하세요

버전: 2026.9

PM > Install-Package IronOcr
nuget.org/packages/IronOcr/
  1. 솔루션 탐색기에서 참조를 마우스 오른쪽 버튼으로 클릭하고 NuGet 패키지 관리를 선택합니다.
  2. 찾아보기를 선택하고 "IronOCR"을 검색하세요.
  3. 패키지를 선택하고 설치하세요
C# PDF DLL
DLL 다운로드

버전: 2026.9

또는 여기에서 Windows 설치 프로그램을 다운로드하십시오.

  1. IronOCR을 다운로드하고 솔루션 디렉터리 내의 ~/Libs와 같은 위치에 압축을 푸세요.
  2. Visual Studio 솔루션 탐색기에서 참조를 마우스 오른쪽 버튼으로 클릭합니다. 찾아보기를 선택하고 "IronOCR.dll"을 선택합니다.

라이선스 가격은 749달러 부터 시작합니다.

Key in blue circle

무료 30일 체험 키를 즉시 받으세요.

Your trial license will be sent to your email address

제한 없음. 100% 무제한 이용. 신용카드 불필요.

bullet_checked신용카드나 계정 생성은 필요하지 않습니다.제한 없음. 100% 무제한 이용. 신용카드 불필요.
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried IronPDF
부담 없는 무료 상담을 받아보세요
아래 양식을 작성하시거나 sales@ironsoftware.com으로 이메일을 보내주세요.
고객님의 정보는 항상 비밀로 유지됩니다.
전 세계 수백만 엔지니어들이 신뢰하는 제품입니다.
Iron Software의 고객 로고
지금 바로 30일 무료 체험판 키를 받으세요.
신용카드나 계정 생성은 필요하지 않습니다.