Porównanie pomiędzy IronOCR a AWS Textract OCR
Co to jest OCR?
Procedura uzywana do przeksztalcania obrazu tekstu w maszynowo odczytywalny format tekstowy jest znana jako Rozpoznawanie Znaków (OCR). Na przyklad, jesli zeskanujesz formularz, fakture lub paragon, twoj komputer zapisze skan jako plik obrazu. Dane w pliku obrazu nie moga byc edytowane, wyszukiwane ani zliczane za pomoca edytora tekstu. Możesz jednak użyć rozwiązań OCR, aby przekonwertować plik graficzny na dokument tekstowy, z którego zawartość jest przechowywana jako dane tekstowe.
W nowoczesnej erze wiekszosc przeplywow pracy w biznesie obejmuje otrzymywanie informacji z mediow drukowanych. Różne dokumenty, takie jak papierowe formularze, faktury, zeskanowane dokumenty prawne, ekstrakcja tabel, drukowany tekst lub kontrakty, są częścią procesów biznesowych. Ponadto cyfryzacja takiej zawartości dokumentacji tworzy obrazy z tekstem ukrytym w ich wnętrzu. Tekst w obrazach nie może być przetwarzany przez narzędzia do edycji tekstu w ten sam sposób co dokumenty tekstowe. Technologia OCR rozwiązuje problem, przekształcając obrazy tekstowe w dane tekstowe, które mogą być analizowane przez inne oprogramowanie biznesowe.
Jak dziala OCR?
Silnik OCR działa, wykorzystując następujące kroki:
Pozyskiwanie obrazu
W tym procesie skaner odczytuje dokumenty i przekształca je w dane binarne. Oprogramowanie OCR identyfikuje zeskanowany obraz i klasyfikuje jasne obszary jako tło, a ciemne obszary jako tekst.
Przetwarzanie wstępne
Oprogramowanie OCR najpierw oczyszcza obraz i usuwa błędy, aby przygotować dane do odczytu.
Rozpoznawanie tekstu
Dwa główne typy algorytmów OCR do rozpoznawania tekstu to dopasowywanie wzorców oraz ekstrakcja cech.
Dopasowywanie wzorców
Obraz znaku, lub glif, jest izolowany podczas procesu dopasowania wzorca i porównywany z wcześniej zarejestrowanym glifem.
Ekstrakcja cech
Poprzez proces ekstrakcji cech, glify zostają podzielone na cechy takie jak linie, zamknięte pętle, kierunek linii i połączenia linii.
Postprocessing
Technologia przeksztalca pobrane dane tekstowe w plik cyfrowy po analizie. Niektóre systemy OCR mogą tworzyć adnotowane dokumenty PDF, które zawierają zarówno wersje przed, jak i po zeskanowaniu dokumentu.
Artykuł ten omawia porównanie dwóch z najczęściej używanych aplikacji i bibliotek dokumentów do OCR:
- IronOCR
- AWS OCR Textract
Biblioteka IronOCR
IronOCR to biblioteka C# .NET, która oferuje usługi skanowania, wyszukiwania, odczytywania obrazów i PDF-ów. Zawiera ponad 125 globalnych pakietów językowych. Wynik jest uzyskiwany jako tekst, dane strukturalne lub przeszukiwalne pliki PDF. Obsluguje wersje .NET, takie jak 6, 5, Core, Standard i Framework.
IronOCR wyróżnia się zdolnością do automatycznego wykrywania i wyodrębniania danych z niedoskonale zeskanowanych obrazów i dokumentów. Klasa 'IronTesseract' ma najbardziej bezpośrednie API. Zapewnia najbardziej zaawansowaną kompilację Tesseract znaną gdziekolwiek, na jakiejkolwiek platformie, z większą prędkością, dokładnością oraz natywnymi bibliotekami DLL i API.
IronOCR moze rowniez skanowac kody kreskowe i kody QR z wszystkich formatow obrazow oraz czyta tekst i wykonuje skanowanie PDF z wykorzystaniem najnowszego silnika Tesseract 5.
Funkcje
Jest stworzony wyłącznie do aplikacji .NET. Może obsługiwać 125 różnych języków. IronOCR obsługuje języki takie jak arabski, chiński, angielski, fiński, francuski, niemiecki, japoński oraz wiele innych. Może poprawić położenie przechylonego obrazu i usunąć szumy z obrazu dla precyzyjnego wyniku. Wykonuje sie doskonale na obrazach o niskiej rozdzielczosci z niskim DPI. Może odczytywać wiele typów kodów QR i kodów kreskowych.
- Obsluguje rowniez formaty Gif i Tiff. Pozwala na wiele wątków jednocześnie. To wybitna funkcja, która nie jest obecna w innych bibliotekach OCR. Usprawnia procesy.
- Latwo wykonuje OCR na plikach PDF i eksportuje przeszukiwalne dokumenty PDF za pomoca OCR.
Teraz przyjrzyjmy się AWS OCR.
AWS OCR Textract
Amazon's AWS Textract to usługa uczenia maszynowego (ML), która automatycznie wydobywa tekst i dane z zeskanowanych dokumentów. Wykorzystuje technologie uczenia głębokiego do identyfikacji, analizy i ekstrakcji danych z formularzy i tabel, wykraczając poza prostą optyczną rozpoznawanie znaków (OCR).
AWS OCR Textract wykorzystuje uczenie maszynowe do odczytywania i przetwarzania dowolnego rodzaju dokumentu, precyzyjnie wydobywając tekst, dane tabelaryczne oraz inne dane bez konieczności ręcznego wysiłku. Zamiast zajmować godziny lub dni na wyodrębnienie danych, Textract może to zrobić szybko. Dodatkowo mozesz dodac recenzje ludzkie za pomoca Amazon Augmented Artificial Intelligence (AI), aby nadzorowac swoje modele i sprawdzac dane wrazliwe.
Funkcje
Wykrywanie tekstu w różnorodnych dokumentach, w tym w raportach finansowych, kartach medycznych, tabelach i formularzach podatkowych.
- Wyciągnij tekst, formularze i dane tabel z dokumentów o ustrukturyzowanych danych, używając Dokumentacja API.
- Określ i wyodrębnij informacje z dokumentów za pomocą funkcji Zapytania w ramach API Analizy Dokumentów.
- Przetwarzaj faktury i paragony za pomocą API Analyze Expense.
- Przetwarzać dokumenty tożsamości, takie jak prawa jazdy i paszporty wydane przez USA rząd, korzystając z API Analyze ID. Skanowalna analiza dokumentow, ktora moze przyspieszyc podejmowanie decyzji.
Dalsza część artykułu wygląda następująco:
- Tworzenie projektu w Visual Studio
- Instalacja IronOCR
- Installing AWS OCR Textract
- PDF do tekstu
- Obraz na tekst
- Kody kreskowe i QR na tekst
- Licencjonowanie
- Podsumowanie
1. Tworzenie projektu w Visual Studio
W tym poradniku zostanie uzyta wersja Visual Studio 2022, wiec zakladam, ze jest juz zainstalowana.
- Otwórz Visual Studio 2022.
- Utwórz nowy projekt .NET Core, a następnie wybierz Console App.
Aplikacja konsolowa
-
Nadaj nazwę projektowi. Np. TextReader. Najbardziej aktualną i stabilną wersją .NET Framework jest 6.0. Będziemy jej używać.

- Kliknij przycisk Utwórz, a projekt zostanie utworzony.
Następnie zainstalujemy biblioteki do naszego użytku po kolei.
2. Instalacja IronOCR
Bibliotekę IronOCR można pobrać i zainstalować na cztery sposoby. Są to:
- Korzystanie z Menedżera pakietów NuGet w Visual Studio.
- Bezpośrednie pobieranie przez stronę internetową NuGet.
- Bezpośrednie pobranie z strony internetowej IronOCR.
- Korzystanie z linii poleceń w Visual Studio.
2.1. Użycie Menedżera NuGet w Visual Studio
Menadżer pakietów NuGet w Visual Studio można użyć do włączenia IronOCR w projekt C#.
- Rozwiń Narzędzia lub kliknij prawym przyciskiem myszy Eksplorator rozwiązań.
- Rozszerzenie Menedżera Pakietów NuGet.
- Kliknij opcję Zarządzaj pakietami NuGet dla rozwiązań lub kliknij Zarządzaj pakietami NuGet w Eksploratorze rozwiązań.
Zarzadzanie pakietami NuGet
Po tym w pasku wyszukiwania pojawi się nowe okno: wpisz IronOCR. Zaznacz pole projektu po prawej stronie i kliknij Zainstaluj.
Przeglądaj IronOCR
Używając tej metody, programiści mogą zainstalować bibliotekę IronOCR oraz dowolny pakiet językowy według wyboru programisty.
2.2. Bezpośrednie pobieranie przez stronę internetową NuGet
IronOCR można pobrać bezpośrednio ze strony NuGet, postępując zgodnie z poniższymi instrukcjami:
- Przejdź do linku "https://www.nuget.org/packages/IronOcr/".
- Wybierz opcję pakietu do pobrania z menu po prawej stronie.
- Kliknij dwukrotnie pakiet do pobrania. Zostanie zainstalowany automatycznie.
- Następnie przeładuj rozwiązanie i zacznij z niego korzystać w projekcie.
2.3. Bezposrednie pobranie przez strone internetowa IronOCR
Programiści mogą pobrać bibliotekę IronOCR bezpośrednio ze strony internetowej, korzystając z tego linku.
- Kliknij prawym przyciskiem myszy projekt w oknie rozwiązania.
- Następnie wybierz opcję Reference i przeszukaj lokalizację pobranej referencji.
- Następnie kliknij OK, aby dodać odwołanie.
2.4. Korzystanie z wiersza poleceń w Visual Studio
- W Visual Studio, przejdź do Narzędzia-> Menedżer pakietów NuGet -> Konsola menedżera pakietów.
- Wpisz następujący wiersz w zakładce konsoli menedżera pakietów:
Install-Package IronOcr
Paczka zostanie teraz pobrana/zainstalowana w bieżącym projekcie i jest gotowa do użycia.
Aplikacja konsolowa
Aplikacja konsolowa
Po wpisaniu polecenia naciśnij Enter, a zostanie ono zainstalowane.
2.5. Dodawanie przestrzeni nazw IronOCR
Aby użyć IronOCR, należy zawrzeć tę linię kodu w programie:
using IronOcr;
using IronOcr;
Imports IronOcr
Teraz zainstalujmy AWS Textract.
3. Installing AWS Textract OCR
Przed rozpoczęciem korzystania z Amazon Textract po raz pierwszy, wykonaj następujące zadania:
- Zarejestruj się w usługach AWS.
- Utworz uzytkownika IAM.
Po pomyślnym założeniu konta i utworzeniu użytkownika IAM, możesz teraz ustawić klucze dostępu w konsoli AWS, aby programowo uzyskać dostęp do API przy użyciu C#. Będziesz potrzebować:
AccessKeyId SecretAccessKey
- RegionEndPoint (Twój obszar dostępu) - W tym przypadku: AFSouth1
3.1. Użycie Menedżera pakietów NuGet
Możesz pobrać i zainstalować AWS Textract SDK z Menedżer pakietów NuGet.
Menedżer pakietów NuGet
- Kliknij Przeglądaj i wyszukaj AWS Textract:
AWS Textract
3.2. Dodawanie przestrzeni nazw AWS OCR
Aby używać AWS Textract, należy dołączyć następujące przestrzenie nazw:
using Amazon.Textract;
using Amazon.Textract.Model;
using Amazon.Textract;
using Amazon.Textract.Model;
Imports Amazon.Textract
Imports Amazon.Textract.Model
4. Plik PDF na tekst
Obie biblioteki mogą wyciągać tekst z plików PDF. Przyjrzyjmy się każdemu fragmentowi kodu po kolei.
4.1. Korzystanie z IronOCR
IronOCR pozwala na rozpoznawanie i odczytywanie tekstu z formatów dokumentów PDF z wykorzystaniem zaawansowanej technologii Tesseract. Poniższy prosty kod jest używany do wyodrębniania informacji:
var Ocr = new IronTesseract();
using (var input = new OcrInput())
{
input.AddPdf("example.pdf", "password");
// We can also select specific PDF page numbers to OCR
var Result = Ocr.Read(input);
Console.WriteLine(Result.Text);
Console.WriteLine($"{Result.Pages.Count()} Pages");
// Read every page of the PDF
}
var Ocr = new IronTesseract();
using (var input = new OcrInput())
{
input.AddPdf("example.pdf", "password");
// We can also select specific PDF page numbers to OCR
var Result = Ocr.Read(input);
Console.WriteLine(Result.Text);
Console.WriteLine($"{Result.Pages.Count()} Pages");
// Read every page of the PDF
}
Dim Ocr = New IronTesseract()
Using input = New OcrInput()
input.AddPdf("example.pdf", "password")
' We can also select specific PDF page numbers to OCR
Dim Result = Ocr.Read(input)
Console.WriteLine(Result.Text)
Console.WriteLine($"{Result.Pages.Count()} Pages")
' Read every page of the PDF
End Using
Kod jest prosty, czysty i bardzo łatwy do zrozumienia oraz użycia.
Wejściowy plik PDF
Przykładowy PDF
Wynik
Wynik IronOCR
4.2. AWS Textract
Amazon Textract ulatwia dodawanie wykrywania i analizy tekstu dokumentow do aplikacji. Nastepujacy kod jest uzywany do odczytania PDF, a ten sam PDF jest przekazywany:
public static async void ReturnResult()
{
AmazonTextractClient client = new AmazonTextractClient("your_access_key_id", "your_secret_access_key", Amazon.RegionEndpoint.AFSouth1);
var request = new StartDocumentTextDetectionRequest();
request.DocumentLocation = new DocumentLocation
{
S3Object = new S3Object
{
Bucket = "your_bucket_name",
Name = "your_bucket_key"
}
};
var id = await client.StartDocumentTextDetectionAsync(request);
var jobId = id.JobId;
var response = client.GetDocumentTextDetectionAsync(new GetDocumentTextDetectionRequest{
JobId = jobId
});
response.Wait();
if (response.Result.JobStatus.Equals("SUCCEEDED"))
{
foreach (var block in response.Result.Blocks)
{
if (block.BlockType == "WORD" || block.BlockType == "PAGE" || block.BlockType == "LINE")
{
Console.WriteLine(block.Text);
}
}
}
}
static void Main(String[] args)
{
ReturnResult();
}
public static async void ReturnResult()
{
AmazonTextractClient client = new AmazonTextractClient("your_access_key_id", "your_secret_access_key", Amazon.RegionEndpoint.AFSouth1);
var request = new StartDocumentTextDetectionRequest();
request.DocumentLocation = new DocumentLocation
{
S3Object = new S3Object
{
Bucket = "your_bucket_name",
Name = "your_bucket_key"
}
};
var id = await client.StartDocumentTextDetectionAsync(request);
var jobId = id.JobId;
var response = client.GetDocumentTextDetectionAsync(new GetDocumentTextDetectionRequest{
JobId = jobId
});
response.Wait();
if (response.Result.JobStatus.Equals("SUCCEEDED"))
{
foreach (var block in response.Result.Blocks)
{
if (block.BlockType == "WORD" || block.BlockType == "PAGE" || block.BlockType == "LINE")
{
Console.WriteLine(block.Text);
}
}
}
}
static void Main(String[] args)
{
ReturnResult();
}
Public Shared Async Sub ReturnResult()
Dim client As New AmazonTextractClient("your_access_key_id", "your_secret_access_key", Amazon.RegionEndpoint.AFSouth1)
Dim request = New StartDocumentTextDetectionRequest()
request.DocumentLocation = New DocumentLocation With {
.S3Object = New S3Object With {
.Bucket = "your_bucket_name",
.Name = "your_bucket_key"
}
}
Dim id = Await client.StartDocumentTextDetectionAsync(request)
Dim jobId = id.JobId
Dim response = client.GetDocumentTextDetectionAsync(New GetDocumentTextDetectionRequest With {.JobId = jobId})
response.Wait()
If response.Result.JobStatus.Equals("SUCCEEDED") Then
For Each block In response.Result.Blocks
If block.BlockType = "WORD" OrElse block.BlockType = "PAGE" OrElse block.BlockType = "LINE" Then
Console.WriteLine(block.Text)
End If
Next block
End If
End Sub
Shared Sub Main(ByVal args() As String)
ReturnResult()
End Sub
Kod jest nieco zawiły, długi i wymaga uwagi podczas przekazywania i pobierania obiektów. Najpierw musimy utworzyć obiekt AmazonTextractClient z trzema parametrami: AccessKeyId, SecretAccessKey i Region. Następnie musimy zainicjować żądanie za pomocą metody StartDocumentTextDetectionRequest(). Obiekt żądania następnie ustawia DocumentLocation za pomocą nazwy i klucza bucketu. To żądanie jest następnie przekazywane do metody StartDocumentTextDetectionAsync(). Ponieważ jest to metoda asynchroniczna, musimy użyć słowa kluczowego await i uczynić funkcję ReturnResult asynchroniczną. Po pomyślnym zakończeniu, wynik jest zwracany, a jobId jest zapisywane. jobId jest przekazywane do metody GetDocumentTextDetectionAsync() i oczekujemy na odpowiedź SUCCEEDED. Pętla foreach jest używana do przechodzenia przez każdy blok i sprawdzania, czy jest "WORD", "PAGE" lub "LINE", a następnie wypisuje rozpoznanie tekstu. Na końcu wywołaj tę metodę w metodzie Main w celu przetwarzania dokumentu.
Wynik
Wynik jest bardzo podobny do IronOCR.
Wynik AWS Textract
5. Obrazy na tekst
Odczytywanie danych z obrazów jest trudne, ponieważ jakość obrazu odgrywa kluczową rolę podczas wydobywania informacji. Obie biblioteki oferują możliwość ekstrakcji tekstu. W tym miejscu użyjemy plików PNG.
5.1. Korzystanie z IronOCR
Kod jest prawie podobny do poprzedniego. Tutaj, metoda AddPDF jest zastępowana metodą AddImage.
var Ocr = new IronTesseract();
using (var Input = new OcrInput())
{
Input.AddImage("test-files/redacted-employmentapp.png");
//... you can add any number of images
var Result = Ocr.Read(Input);
Console.WriteLine(Result.Text);
}
var Ocr = new IronTesseract();
using (var Input = new OcrInput())
{
Input.AddImage("test-files/redacted-employmentapp.png");
//... you can add any number of images
var Result = Ocr.Read(Input);
Console.WriteLine(Result.Text);
}
Dim Ocr = New IronTesseract()
Using Input = New OcrInput()
Input.AddImage("test-files/redacted-employmentapp.png")
'... you can add any number of images
Dim Result = Ocr.Read(Input)
Console.WriteLine(Result.Text)
End Using
Obraz wejściowy
Zredagowane dane pracowników
Wynik
Wynik jest czysty i pasuje do oryginalnego obrazu przy zaledwie kilku liniach kodu, bez zawiłości technicznych i z doskonałym rezultatem.
Wynik obrazu
5.2. Korzystanie z AWS Textract
Poniższy kod pomaga wykrywać tekst z obrazów:
public static async void ReturnResult()
{
AmazonTextractClient client = new AmazonTextractClient("your_access_key_id", "your_secret_access_key", Amazon.RegionEndpoint.AFSouth1);
var request = new DetectDocumentTextRequest();
request.Document = new Document
{
Bytes = new MemoryStream(File.ReadAllBytes(@"test-files/redacted-employmentapp.png"))
};
var result = await client.DetectDocumentTextAsync(request);
foreach (var block in result.Blocks)
{
if (block.BlockType == "WORD")
{
Console.WriteLine(block.Text);
}
}
}
static void Main(String[] args)
{
ReturnResult();
}
public static async void ReturnResult()
{
AmazonTextractClient client = new AmazonTextractClient("your_access_key_id", "your_secret_access_key", Amazon.RegionEndpoint.AFSouth1);
var request = new DetectDocumentTextRequest();
request.Document = new Document
{
Bytes = new MemoryStream(File.ReadAllBytes(@"test-files/redacted-employmentapp.png"))
};
var result = await client.DetectDocumentTextAsync(request);
foreach (var block in result.Blocks)
{
if (block.BlockType == "WORD")
{
Console.WriteLine(block.Text);
}
}
}
static void Main(String[] args)
{
ReturnResult();
}
Public Shared Async Sub ReturnResult()
Dim client As New AmazonTextractClient("your_access_key_id", "your_secret_access_key", Amazon.RegionEndpoint.AFSouth1)
Dim request = New DetectDocumentTextRequest()
request.Document = New Document With {.Bytes = New MemoryStream(File.ReadAllBytes("test-files/redacted-employmentapp.png"))}
Dim result = Await client.DetectDocumentTextAsync(request)
For Each block In result.Blocks
If block.BlockType = "WORD" Then
Console.WriteLine(block.Text)
End If
Next block
End Sub
Shared Sub Main(ByVal args() As String)
ReturnResult()
End Sub
Ponownie, kod jest prawie podobny do poprzedniego. Tutaj musimy zainicjować żądanie za pomocą metody DetectDocumentTextRequest(). Obiekt zadania następnie ustawia dokument, odczytując wszystkie bajty. To żądanie jest następnie przekazywane do metody DetectDocumentTextAsync(). Ponieważ jest to metoda asynchroniczna, musimy użyć słowa kluczowego await i uczynić funkcję ReturnResult asynchroniczną. W przypadku powodzenia wynik zostanie zwrócony w blokach. Pętla foreach jest używana do przechodzenia przez każdy blok i sprawdzania, czy jest "WORD", a następnie wypisuje rozpoznanie tekstu. Na końcu wywołaj tę metodę w metodzie Main w celu przetwarzania dokumentu.
Wynik jest podobny do IronOCR, ale najpierw należy przesłać plik do zasobnika AWS.
6. Kod kreskowy i kod QR na tekst
Unikalną funkcją IronOCR jest możliwość odczytu kodów kreskowych i QR z dokumentów podczas skanowania w poszukiwaniu tekstu. Instancje klasy OcrResult.OcrBarcode dostarczają deweloperowi szczegółowych informacji o każdym zeskanowanym kodzie kreskowym. AWS Textract nie oferuje tej funkcjonalności.
Kod dla IronOCR jest podany poniżej:
var Ocr = new IronTesseract();
Ocr.Configuration.ReadBarCodes = true;
using (var input = new OcrInput())
{
input.AddImage("test-files/Barcode.png");
var Result = Ocr.Read(input);
foreach (var Barcode in Result.Barcodes)
{
Console.WriteLine(Barcode.Value);
// type and location properties also exposed
}
}
var Ocr = new IronTesseract();
Ocr.Configuration.ReadBarCodes = true;
using (var input = new OcrInput())
{
input.AddImage("test-files/Barcode.png");
var Result = Ocr.Read(input);
foreach (var Barcode in Result.Barcodes)
{
Console.WriteLine(Barcode.Value);
// type and location properties also exposed
}
}
Dim Ocr = New IronTesseract()
Ocr.Configuration.ReadBarCodes = True
Using input = New OcrInput()
input.AddImage("test-files/Barcode.png")
Dim Result = Ocr.Read(input)
For Each Barcode In Result.Barcodes
Console.WriteLine(Barcode.Value)
' type and location properties also exposed
Next Barcode
End Using
Kod jest samowyjaśniający się i łatwy do zrozumienia.
7. Licencjonowanie
IronOCR to biblioteka, która oferuje darmową licencję dla deweloperów. Ma również odmienną strukturę cenową; Pakiet Lite zaczyna się od $999 bez ukrytych opłat. Możliwa jest również redystrybucja produktów SaaS i OEM. Wszystkie licencje oferują 30-dniową gwarancję zwrotu pieniędzy, rok wsparcia i aktualizacji oprogramowania, ważność dla środowisk deweloperskich, testowych i produkcyjnych, oraz licencję wieczystą (jednorazowy zakup). Aby zobaczyć całą strukturę cenową i szczegóły licencjonowania IronOCR, przejdź tutaj.
Plan cenowy IronOCR
Możesz uzyskać redystrybucję produktów SaaS i OEM jako usługa bez opłat licencyjnych za jednorazową cenę $1,599.
Usługa SAAS
API AWS Textract zapewnia programistom usługę AWS Free Tier. Możesz rozpocząć korzystanie z Amazon Textract za darmo. Free Tier trwa trzy miesiące, a poniżej przedstawiono ceny.

Lista cenowa
Możesz zapoznać się ze szczegółami cenowymi pod tym linkiem. Ponadto możesz dostosować ceny do swoich potrzeb, używając kalkulatora cen.
8. Podsumowanie
IronOCR oferuje programistom C# najnowocześniejsze API Tesseract, które znamy na każdej platformie. IronOCR można wdrożyć na Windows, Linux, Mac, Azure, AWS, Lambda i obsługuje projekty .NET Framework oraz .NET Standard i .NET Core. Możemy również czytać kody kreskowe w skanach OCR i eksportować nasz OCR jako HTML i przeszukiwalne PDF.
Amazon Textract ulatwia dodawanie wykrywania i analizy tekstu dokumentow do aplikacji. Amazon Textract opiera się na sprawdzonej, wysoce skalowalnej technologii głębokiego uczenia, opracowanej przez naukowców zajmujących się wizją komputerową Amazon do analizy miliardów obrazów i filmów każdego dnia. Nie potrzebujesz żadnej wiedzy z zakresu uczenia maszynowego, aby go używać. Amazon Textract zawiera proste, łatwe w użyciu interfejsy API, które mogą analizować pliki obrazów i pliki PDF. Amazon Textract zawsze uczy się z nowych danych, a Amazon nieustannie dodaje nowe funkcje do tej usługi.
Licencje IronOCR są oparte na programistach, co oznacza, że zawsze należy kupić licencję w zależności od liczby programistów, którzy będą korzystać z produktu. Licencje AWS Textract są oparte na liczbie stron dokumentu, na których chcemy wyodrębnić informacje i przeanalizować dane. Licencje są miesięczne, a ceny stają się bardzo wysokie przy dużej liczbie stron w porównaniu do licencji IronOCR. Ponadto licencja na IronOCR jest zakupem jednorazowym i można ją używać przez całe życie, a także obsługuje dystrybucję OME i SaaS.
W ogólnym porównaniu, IronOCR i AWS OCR mają możliwości uczenia maszynowego do wykrywania tekstu z dokumentu lub obrazu. IronOCR ma lekką przewagę nad AWS OCR, ponieważ jest szybki i oszczędzający czas. Kod jest prosty i przejrzysty przy wykrywaniu tekstu z dokumentów. Zadanie jest realizowane w kilku metodach. Z drugiej strony AWS Textract używa wielu metod do wykonania tego samego zadania. To zwiększa czas odpowiedzi serwera i czasami jest czasochłonne. Widać, że jeśli wprowadzimy nawet niedoskonały dokument do IronOCR, potrafi dokładnie odczytać jego zawartość z dokładnością statystyczną na poziomie około 99%, mimo że dokument był źle sformatowany, przechylony i z cyfrowym szumem. IronOCR działa prosto, bez potrzeby dostrajania wydajności lub gruntownej modyfikacji wprowadzanych obrazów. Prędkość jest oszałamiająca: IronOCR.2020+ jest do 10 razy szybszy i popełnia o ponad 250% mniej błędów niż poprzednie wersje.
Ponadto, Iron Software obecnie oferuje pakiet pięciu narzędzi w cenie tylko dwóch. Narzędzia zawarte w Iron Suite to:
- IronBarcode
- IronXL
- IronOCR
- IronPDF
- IronWebScraper
Odwiedź ten link, aby przejrzeć Iron Suite.
Często Zadawane Pytania
Czym jest optyczne rozpoznawanie znaków (OCR)?
Optyczne rozpoznawanie znaków (OCR) to technologia, która przekształca różne rodzaje dokumentów, takie jak zeskanowane dokumenty papierowe, pliki PDF lub zdjęcia zrobione aparatem cyfrowym, w dane, które można edytować i przeszukiwać. IronOCR to potężna biblioteka C# .NET, która usprawnia ten proces dzięki zaawansowanym algorytmom.
Jak mogę przekonwertować obrazy tekstu na tekst czytelny dla komputera przy użyciu języka C#?
Możesz użyć biblioteki IronOCR, biblioteki C# .NET, do konwersji obrazów tekstu na tekst czytelny dla komputera. Przetwarza ona obrazy za pomocą zaawansowanych algorytmów OCR i generuje rozpoznany tekst w formatach, które można łatwo przetwarzać programowo.
Jak IronOCR radzi sobie z niedoskonale zeskanowanymi obrazami?
IronOCR został zaprojektowany do efektywnego zarządzania i przetwarzania niedoskonale zeskanowanych obrazów. Zawiera funkcje przetwarzania wstępnego, które korygują przekrzywienie, poprawiają kontrast tekstu i udoskonalają jakość obrazu w celu zwiększenia dokładności OCR.
Czy mogę używać IronOCR do przetwarzania wielowątkowego?
Tak, IronOCR obsługuje wielowątkowość, co pozwala na jednoczesne przetwarzanie wielu dokumentów, znacznie zwiększając wydajność i przepustowość w aplikacjach obsługujących duże ilości dokumentów.
Jakie języki obsługuje IronOCR w zadaniach OCR?
IronOCR obsługuje ponad 125 języków, co czyni go wszechstronnym narzędziem do globalnych zastosowań, w których dokumenty w wielu językach muszą być przetwarzane i konwertowane na tekst.
Jak zainstalować IronOCR w projekcie Visual Studio?
IronOCR można zainstalować w projekcie Visual Studio za pomocą menedżera pakietów NuGet. Wystarczy wyszukać „IronOCR” w konsoli NuGet i zainstalować go, co pozwoli na zintegrowanie funkcji OCR z aplikacjami .NET.
Jaki jest model cenowy IronOCR?
IronOCR oferuje model licencji jednorazowej. Obejmuje to Licencje wieczyste z 30-dniową gwarancją zwrotu pieniędzy, co zapewnia programistom elastyczność i spokój ducha.
Czym AWS Textract różni się od IronOCR pod względem technologii?
AWS Textract wykorzystuje technologie uczenia maszynowego i głębokiego uczenia się do wyodrębniania tekstu i danych, zapewniając szczegółową analizę treści dokumentów. Natomiast IronOCR koncentruje się na łatwości użytkowania i integracji z projektami .NET, oferując solidne rozwiązanie OCR z obszerną obsługą języków.
Czy IronOCR potrafi odczytywać i przetwarzać kody kreskowe oraz kody QR?
Tak, IronOCR potrafi odczytywać i przetwarzać zarówno kody kreskowe, jak i kody QR. Wyodrębnia szczegółowe informacje o każdym kodzie, jednocześnie skanując tekst, co czyni go wszechstronnym narzędziem do przetwarzania dokumentów.
Jakie platformy i środowiska obsługują IronOCR?
IronOCR jest kompatybilny z szeroką gamą środowisk, w tym Windows, Linux, Mac, Azure, AWS i Lambda. Obsługuje projekty .NET Framework, .NET Standard i .NET Core, zapewniając elastyczność w różnych ekosystemach programistycznych.

