
C#에서 스크린샷에서 OCR을 사용하여 텍스트를 추출하는 방법
많은 사람들이 'OCR 스크린샷이란 무엇인가?'에 대해 궁금해할 수 있습니다. 다른 사람들은 어떤 텍스트의 스크린샷을 디지털 텍스트 편집 가능 형식이나 .txt, .doc 형식으로 변환하는 방법을 궁금해 할 수 있습니다. 이들 중 한 사람이라면, 더 이상 걱정하지 마세요. 우리는 당신에게 완벽한 솔루션을 가지고 있습니다.
이 기사에서는 스크린샷에서 OCR, 광학 문자 인식을 수행할 수 있는 다양한 도구를 논의할 것입니다.
다양한 OCR 도구가 있지만 오늘은 IronOCR를 사용하여 스크린샷에서 텍스트를 추출할 것입니다.
1. IronOCR
IronOCR는 C# 및 VB.NET 프로그래밍 언어를 위한 소프트웨어 라이브러리로, 개발자가 애플리케이션에 OCR (광학 문자 인식) 기능을 추가할 수 있도록 설계되었습니다. 이 라이브러리는 이미지에서 텍스트를 인식하고 이를 기계 판독 가능한 텍스트로 변환하는 데 사용될 수 있습니다. 이 라이브러리는 가장 정확한 OCR 엔진 중 하나로 간주되는 Tesseract OCR 엔진을 기반으로 만들어졌습니다.
IronOCR 은 PNG, JPG, TIFF, PDF를 포함한 다양한 파일 형식의 이미지에서 텍스트를 읽을 수 있습니다. 또한 여러 언어를 인식할 수 있는 기능 및 회전되거나 구부러진 이미지에서 텍스트를 인식 할 수 있는 기능 등 텍스트 인식 작업을 위한 다양한 고급 기능을 제공합니다. 추가적으로, 개발자는 IronOCR 를 사용하여 C# 또는 VB.NET 코드에서 호출할 수 있는 간단하고 사용하기 쉬운 API를 제공하여 애플리케이션에 OCR 기능을 빠르게 통합할 수 있습니다. IronOCR를 사용하면 OCR 언어를 선택하고 이미지, 디지털 PDF 파일 및 스캔된 PDF 파일에서 OCR을 수행할 수 있습니다.
IronOCR는 애플리케이션에 OCR 기능을 추가하려는 개발자에게 좋은 옵션으로 간주됩니다. 오픈 소스이며 사용 및 통합이 쉽고, 빠르고, 정확하며 최신의 OCR 기술과 최신 상태입니다.
2. IronOCR 기능
IronOCR는 개발자가 애플리케이션에 OCR 기능을 통합할 수 있도록 많은 기능을 제공합니다. IronOCR의 주요 기능들 중 일부는 다음과 같습니다:
- 다국어 지원: IronOCR는 영어, 스페인어, 독일어, 프랑스어, 이탈리아어, 중국어를 포함하여 60개 이상의 언어로 텍스트를 인식할 수 있습니다.
- 자동 텍스트 방향 감지: IronOCR는 이미지가 회전되거나 기울어졌더라도 이미지 안의 텍스트 방향을 자동으로 감지할 수 있습니다.
- 다양한 이미지 형식 지원: IronOCR는 PNG, JPG, TIFF, PDF를 포함한 다양한 형식의 이미지에서 텍스트를 읽을 수 있습니다.
- 맞춤 인식 설정: 개발자는 특정 이미지 유형이나 사용 사례에 대한 인식 정확도를 높이기 위해 인식 설정을 맞춤화할 수 있습니다.
- 다중 페이지의 스캔된 문서 및 PDF에서 텍스트를 인식할 수 있는 기능.
- 빠른 인식 및 높은 정확도: IronOCR는 가장 정확하고 널리 사용되는 OCR 엔진 중 하나인 Tesseract OCR 엔진을 사용합니다.
- 간단한 사용 API: IronOCR는 C# 또는 VB.NET 코드에서 호출할 수 있는 간단하고 사용하기 쉬운 API를 제공하여 애플리케이션에 OCR 기능을 쉽게 통합할 수 있게 합니다.
전반적으로, IronOCR는 개발자가 애플리케이션에 OCR 기능을 추가하는 데 도움이 되는 다양한 기능을 제공하는 강력한 도구입니다.
3. Visual Studio에서 새 프로젝트 생성
Visual Studio를 열고 파일 메뉴로 이동하세요. "새 프로젝트"를 선택한 후 콘솔 애플리케이션을 선택하세요.
프로젝트 이름을 입력하고 적절한 텍스트 상자에서 경로를 선택합니다. 그런 다음 만들기 버튼을 클릭합니다. 아래 스크린샷처럼 필수 .NET Framework를 선택하세요:
Visual Studio에서 새로운 프로젝트 생성하기
Visual Studio 프로젝트는 이제 콘솔 애플리케이션의 구조를 생성할 것입니다. 완료되면, 이 코드를 program.cs 파일에 작성하고 실행할 수 있습니다.
Visual Studio의 새 프로젝트 마법사에서 생성된 program.cs 파일
이제 IronOCR 라이브러리를 추가하고 프로그램을 테스트할 수 있습니다.
4. IronOCR 설치하기
Visual Studio에서 C# 프로젝트와 IronOCR를 쉽게 통합할 수 있습니다.
IronOCR는 C# .NET 프로젝트와의 통합을 위한 여러 가지 방법을 제공합니다. 여기서는 NuGet 패키지 관리자를 사용하여 IronOCR를 설치하는 방법을 논의할 것입니다.
Visual Studio에서 도구 > NuGet 패키지 관리자 > 패키지 관리자 콘솔로 이동합니다.
NuGet 패키지 관리자 UI
클릭한 후, Visual Studio 창 하단에 새로운 콘솔이 나타납니다. 콘솔에 아래 명령어를 입력하고 엔터를 누르세요.
IronOCR는 몇 초 안에 설치됩니다.
5. IronOCR를 사용하여 스크린샷에서 OCR 수행하기
IronOCR는 스크린샷에서 텍스트를 인식할 수 있는 강력한 OCR 라이브러리입니다. IronOCR를 사용하면 텍스트의 스크린샷을 찍고, 라이브러리의 OCR 기능을 사용하여 스크린샷의 텍스트를 디지털, 편집 가능한 형식으로 변환할 수 있습니다. C#에서 스크린샷에서 OCR을 수행하는 IronOCR를 사용하는 방법의 예가 여기 있습니다. 스크린샷 OCR을 수행하려면 스크린샷을 캡처하고 아래 코드를 실행하여 원하는 출력 형식으로 텍스트를 추출하세요.
using IronOcr;
using System;
class Program
{
static void Main()
{
// Create an instance of IronTesseract, the core OCR engine
var ocr = new IronTesseract();
// Perform OCR on the specified image file
var result = ocr.Read("ocr.png");
// Output the recognized text to the console
Console.WriteLine(result.Text);
}
}Imports IronOcr
Imports System
Friend Class Program
Shared Sub Main()
' Create an instance of IronTesseract, the core OCR engine
Dim ocr = New IronTesseract()
' Perform OCR on the specified image file
Dim result = ocr.Read("ocr.png")
' Output the recognized text to the console
Console.WriteLine(result.Text)
End Sub
End Class입력 이미지 파일
입력에 사용된 샘플 스크린샷
텍스트 출력
- IRONOCR for NET
- The C# OCR Library
- OCR for C# to scan and read images & PDFs
- NET OCR library with 125+ global language packs
- Output as text, structured data, or searchable PDFs
- Supports NET 6, 5, Core, Standard, Framework
6. 특정 영역에서 IronOCR 사용하여 OCR 수행하기
IronOCR는 이미지 내 특정 영역에서 OCR을 수행할 수 있도록 합니다. 이미지에 여러 텍스트 영역이 있을 때 특정 영역의 텍스트만 인식하고 싶을 때 유용할 수 있습니다. 이를 위한 코드 예제는 아래에 나와 있습니다.
using IronOcr;
using IronSoftware.Drawing;
using System;
class Program
{
static void Main()
{
var ocrTesseract = new IronTesseract();
using (var ocrInput = new OcrInput())
{
// Define the rectangle to crop the image for OCR
var contentArea = new CropRectangle(x: 0, y: 0, width: 350, height: 150);
// Add the image with the specified cropping area
ocrInput.AddImage("ocr.png", contentArea);
// Perform the OCR operation on the defined area
var ocrResult = ocrTesseract.Read(ocrInput);
// Output the recognized text
Console.WriteLine(ocrResult.Text);
}
}
}Imports IronOcr
Imports IronSoftware.Drawing
Imports System
Friend Class Program
Shared Sub Main()
Dim ocrTesseract = New IronTesseract()
Using ocrInput As New OcrInput()
' Define the rectangle to crop the image for OCR
Dim contentArea = New CropRectangle(x:= 0, y:= 0, width:= 350, height:= 150)
' Add the image with the specified cropping area
ocrInput.AddImage("ocr.png", contentArea)
' Perform the OCR operation on the defined area
Dim ocrResult = ocrTesseract.Read(ocrInput)
' Output the recognized text
Console.WriteLine(ocrResult.Text)
End Using
End Sub
End Class산출
- IRONOCR for NET
- The C# OCR Library
- OCR for C# to scan and read images & PDFs
- NET OCR library with 125+ global language packs
7. 이미지에서 IronOCR 사용하여 OCR 수행하기
이미지에서 OCR을 수행하고 인식된 텍스트를 .txt 파일에 저장하려면 다음 코드를 사용할 수 있습니다.
using IronOcr;
using System;
class Program
{
static void Main()
{
var ocr = new IronTesseract();
using (var input = new OcrInput("ocr.png"))
{
// Perform OCR on the image
var result = ocr.Read(input);
// Save the recognized text to a .txt file
result.SaveAsTextFile("output.txt");
}
}
}Imports IronOcr
Imports System
Friend Class Program
Shared Sub Main()
Dim ocr = New IronTesseract()
Using input = New OcrInput("ocr.png")
' Perform OCR on the image
Dim result = ocr.Read(input)
' Save the recognized text to a .txt file
result.SaveAsTextFile("output.txt")
End Using
End Sub
End Class출력 파일의 내용은 아래에 나와 있습니다:
생성된 output.txt 파일의 내용
8. 더 알아보기
이미지에서 텍스트를 추출하는 방법에 대한 더 많은 정보를 원하시면 이미지 텍스트 추출 튜토리얼을 읽어보세요.
IronOCR는 다양한 유형의 문서와 작업할 수 있도록 설계된 다섯 개의 .NET 라이브러리 suite의 일부입니다. 다섯 개의 라이브러리를 단 두 개의 라이센스 가격으로 구매할 수 있습니다.

관련 기사

