Przejdź do treści stopki
PORóWNAJ Z INNYMI KOMPONENTAMI

Porównanie pomiędzy Google OCR a IronOCR

OCR oznacza optyczne rozpoznawanie znaków. Umozliwia konwersje pliku obrazu do tekstu kodowanego maszynowo. Zeskanowane dokumenty sa zawsze zapisywane jako plik obraz przez komputer. Dane w tych plikach obraz nie moga byc przeszukiwane, edytowane lub zapisywane w formacie tekstowym za pomoca zwyklego edytora tekstu lub nawet za pomoca aplikacji do przetwarzania tekstu. Przetwarzanie OCR pomaga w konwersji tych obrazow do tekstu czytanego maszynowo do dalszego przetwarzania przez jego uzytkownikow.

W tej nowoczesnej epoce zeskanowane dokumenty udostepniane przez internet sa w formacie cyfrowym, glownie w formie PDF-ow lub obrazow. Istnieje wiele dostepnych zasobow online, ktore konwertuja obraz na tekst. Jednak większość firm wymaga tej funkcjonalności w swoich aplikacjach. Miejac to na uwadze, istnieje wiele bibliotek, ktore dostarczaja technologie przetwarzania OCR do osadzenia w aplikacjach oprogramowania.

W tym artykułe omówimy dwie najpopularniejsze biblioteki OCR dla języka C#. Są to:

  • IronOCR
  • Google Cloud Vision OCR (Vision API)

IronOCR - Biblioteka C

IronOCR dla .NET to biblioteka C# do skanowania, wyszukiwania i czytania obrazow i PDFów. Pobiera obraz lub plik PDF jako dane wejsciowe i uzywa najnowszego niestandardowego silnika OCR Tesseract 5 dla .NET do wydania tekstu, danych strukturalnych lub przeszukiwalnych dokumentow PDF. Tesseract jest dostepny w ponad 125 jezykach, wraz z wsparciem wieloplatformowym w .NET Core i .NET Standard, od wersji 2.0 do 7.

IronOCR to przyjazne dla użytkownika API, które pozwala programistom C# automatycznie konwertować obrazy na tekst za pomocą klasy IronTesseract i klucza API. Priorytetem jest szybkosc, dokladnosc i latwosc uzycia. Wspomaga rowniez API Computer Vision w poszukiwaniu tekstu poprzez zestaw trenowanych modeli.

Inna potega funkcja IronOCR to jego zdolnosc do skanowania kodow kreskowych i kodow QR z wszystkich plikow obrazow i czytanie ich tekstu. Inne wazne funkcje IronOCR sa podane ponizej.

Funkcje

  • Miedzynarodowe Jezyki: 125+ i wsparcie dla jezykow niestandardowych z wysoka i szybka jakoscia
  • Czytanie Tekstu i Kodow Kreskowych: Odczytywanie tekstu i liczb z wielu jezykow jednoczesnie
  • Specjalistyczne Dokumenty: Wyspecjalizowana umiejetnosc czytania tekstu z paragonow, czekow, faktur
  • Odczyt z wielu formatów: Obrazy (PNG, JPG, GIF, TIFF, BMP), System.Drawing Objects, strumienie, dokumenty PDF (optymalizowane docelowe DPI)
  • Filtry: Kreator filtrow, Korekcja obrazow, Naprawa orientacji obrazu, Naprawa kolorow obrazu
  • Proste Wyniki Danych: Ciagi Tekstowe .NET, Dane Kodow Kreskowych i QR, Obrazy

Teraz przyjrzyjmy sie Google Cloud Vision API.

Google Cloud Vision OCR

Google Cloud Vision API to biblioteka klienta OCR Google Cloud wspierajaca jezyk C#. Pozwala deweloperom C# latwo integrowac funkcje detekcji wizji komputerowej do aplikacji oprogramowania. Wykonuje OCR i rozpoznawanie tekstu z plikow obrazow, etykiet obrazow, detekcja twarzy i detekcja punktow orientacyjnych.

Google Cloud Vision API wykorzystuje REST i RPC API, aby zapewnic mocny, wstepnie zaprogramowany model ML (uczenia maszynowego). Dzieki Cloud Vision API mozesz szybko klasyfikowac obrazy na miliony juz zdefiniowanych kategorii. Moze rowniez wykrywac obiekty i czytac tekst z drukowanych dokumentow jak i recznie pisanego tekstu.

Funkcje

  • Rozpoznawanie Tekstu z Obrazu: OCR obrazu do rozpoznawania tekstu i konwertowanie go na kod jezyka maszynowego
  • Rozpoznawanie Tekstu z Dokumentow: OCR pliku (PDF/TIFF), geste teksty
  • Detekcja Punktow Orientacyjnych: Zwraca koordynaty wykrytych obiektow
  • Detekcja Logo: Zwraca opis tekstowy
  • Detekcja Etykiet: Zwraca ogolne etykiety dla obrazu

Dalsza część artykułu wygląda następująco:

  1. Tworzenie Projektu w Visual Studio
  2. Instalacja IronOCR
  3. Instalacja Google OCR
  4. Obraz na tekst
  5. Kod Kreskowy i Kody QR na Tekst
  6. PDF na tekst
  7. Licencjonowanie
  8. Podsumowanie

1. Tworzenie Projektu w Visual Studio

W tym kursie instruujacym bedzie uzywac najnowszej wersji Visual Studio 2022. Wiec zakladam, ze juz pobrales i zainstalowales Visual Studio do C#. Jesli nie, mozesz pobrac go z strony Visual Studio.

Teraz musimy stworzyc projekt Konsoli, aby zaczac z obiema bibliotekami. Wykonaj poniższe kroki, aby utworzyć projekt:

  • Otworz Visual Studio 2022.
  • Kliknij Utworz nowy projekt.

    Jak drukować kod kreskowy w aplikacji Windows C# Rysunek 1 - Utwórz nowy projekt

  • Wybierz Aplikacje Konsoli C# z podanych opcji.

    Jak drukować kod kreskowy w aplikacji Windows C# Rysunek 2 - Aplikacja konsolowa

  • Skonfiguruj nowy projekt z nazwa i lokalizacja. Np. "ProjektOCR".
  • Kliknij Dalej.

    Jak drukować kod kreskowy w aplikacji Windows C# Rysunek 3 - Konfiguracja projektu

  • Z dodatkowych informacji, wybierz .NET Framework 6.0 jako najstabilniejsza wersje.

    Jak drukować kod kreskowy w aplikacji Windows C# Rysunek 4 - Dodatkowe informacje

  • Teraz kliknij Utworz, a projekt zostanie utworzony w okreslonej przez ciebie lokalizacji.

Następnie zainstalujemy biblioteki w naszym projekcie w celu porównania.

2. Instalacja IronOCR

Istnieje wiele sposobów instalacji biblioteki IronOCR. Przyjrzyjmy się im po kolei.

2.1. Korzystanie z menedżera pakietów NuGet w Visual Studio

NuGet to menedżer pakietów służący do pobierania i instalowania zależności w projekcie. Jego pakiety zawieraja skompilowany kod (DLL) i plik manifestu. Uzyskaj do niego dostep za pomoca ponizszej metody:

  • Kliknij na zakladke Narzedzia
  • Rozszerz opcje MeneKomenysia Pakietow NuGet
  • Kliknij Zarzadzaj Pakietami NuGet dla Rozwiazania

    Jak drukować kod kreskowy w aplikacji Windows C# Rysunek 5 - Menedżer pakietów NuGet

  • lub, kliknij prawym przyciskiem Rozwiazanie Eksploratora
  • Kliknij Zarzadzaj Pakietami NuGet

    Jak drukować kod kreskowy w aplikacji Windows C# Rysunek 6 - Eksplorator rozwiązań

Otworzy się okno menedżera pakietów NuGet. Wyszukaj IronOCR i kliknij Zainstaluj.

Jak drukować kod kreskowy w aplikacji Windows C# Rysunek 7 - IronOCR

2.2. Pobierz ze strony NuGet

Mozna go pobrac bezposrednio z oficjalnej strony internetowej NuGet. Postepuj zgodnie z podanymi krokami:

  1. Kliknij na link do strony NuGet.
  2. Kliknij opcje Pobierz pakiet po prawej stronie strony.
  3. Otworz pobrany pakiet i rozpocznie sie instalacja.
  4. Na koniec, przeladuj rozwiazanie, i gotowe.

2.3. Pobieranie za pomocą strony internetowej IronOCR

Wystarczy odwiedzic strone internetowa Iron Software i przejsc do strony IronOCR dla .NET. Przewin na dol i kliknij Pobierz DLL lub Pobierz Instalatora Windows.

Jak drukować kod kreskowy w aplikacji Windows C# Rysunek 8 - Strona internetowa Iron Software

Pobrany zostanie plik ZIP. Wyciagnij go i dodaj do swojego pliku projektu lub uruchom Instalator Windows. Postepuj zgodnie z ponizszymi krokami, aby dodac go do swojego projektu.

  1. Kliknij prawym przyciskiem myszy zaleznosci projektu w Visual Studio z Eksploratora Rozwiazan.
  2. Nastepnie wybierz opcje Dodaj Odwolanie do Projektu.
  3. Przejdź do lokalizacji pobranego pliku DLL.
  4. Na koniec, kliknij OK, aby dodac odwolanie do projektu.

2.4. Uzywajac Wiersza Polecen w Visual Studio

  1. Przejdź do zakładki Narzędzia w programie Visual Studio.
  2. Rozszerz opcję menedżera pakietów NuGet.
  3. Wybierz Konsolę menedżera pakietów i wpisz następujące polecenie:
Install-Package IronOcr

Spowoduje to automatyczne pobranie i zainstalowanie IronOCR w Twoim projekcie.

Teraz jesteśmy gotowi do użycia IronOCR w naszym projekcie.

2.5. Dodawanie Niezbednych Przestrzeni Nazwowych IronOCR

Istnieje tylko jedna przestrzen nazwowa, ktora nalezy dodac na górze pliku zrodłowego, gdzie chcemy uzyskac dostep do jego funkcji.

using IronOcr;
using IronOcr;
Imports IronOcr
$vbLabelText   $csharpLabel

Teraz zainstalujmy Google Vision OCR.

3. Instalacja Google OCR

Aby moc uzywac Vision API w twoim projekcie C#, musisz spelniac nastepujace wymagania:

  1. Utworz konto Google
  2. Utworz nowy projekt z konsoli Google Cloud
  3. Aktywuj fakturowanie
  4. Aktywuj Vision API
  5. Utworz Konto Usługe i ustaw dane uwierzytelniajace
  6. Pobierz klucz danych uwierzytelniajacych konto usługi w formacie pliku JSON

Możesz zobaczyc szczegółowe instrukcje dotyczace konfiguracji i wymagan korzystania z Google Cloud Vision z oficjalnej dokumentacji tutaj.

Teraz, aby zainstalowac biblioteke klienta Google Cloud do wykonywania przetwarzania OCR w Visual Studio, musimy uzyc Menedzera Pakietow NuGet.

3.1. Użycie Menedżera pakietów NuGet

Uzyskaj dostep przez ponizsza metode:

  • Kliknij na zakladke Narzedzia
  • Rozszerz opcje MeneKomenysia Pakietow NuGet
  • Kliknij Zarzadzaj Pakietami NuGet dla Rozwiazania

    Jak drukować kod kreskowy w aplikacji Windows C# Rysunek 9 - Karta Narzędzia

  • lub, kliknij prawym przyciskiem Rozwiazanie Eksploratora
  • Kliknij Zarzadzaj Pakietami NuGet

    Jak drukować kod kreskowy w aplikacji Windows C# Rysunek 10 - Zarządzaj pakietami NuGet

Otworzy się okno menedżera pakietów NuGet. Przegladaj Google Cloud Vision OCR i kliknij Zainstaluj.

Jak drukować kod kreskowy w aplikacji Windows C# Rysunek 11 - Google Cloud Vision OCR

3.2. Dodawanie Przestrzeni Nazwowej API Google Vision

Uwzglednij ponizsza przestrzen nazwowa, aby uzyc Google OCR Vision API:

using Google.Cloud.Vision.V1;
using Google.Cloud.Vision.V1;
Imports Google.Cloud.Vision.V1
$vbLabelText   $csharpLabel

Ustaw rowniez zmienna srodowiskowa z kluczem uwierzytelniajacym pobrany w formacie pliku JSON.

Environment.SetEnvironmentVariable("GOOGLE_APPLICATION_CREDENTIALS", "key.json");
Environment.SetEnvironmentVariable("GOOGLE_APPLICATION_CREDENTIALS", "key.json");
Environment.SetEnvironmentVariable("GOOGLE_APPLICATION_CREDENTIALS", "key.json")
$vbLabelText   $csharpLabel

Teraz wszystko jest skonfigurowane i gotowe do użycia.

4. Obraz na Tekst

Czytanie danych z obrazow to żmudne zadanie. Rozdzielczość i jakość obrazu odgrywają ważną rolę podczas wyodrębniania treści. Obie biblioteki dostarczaja funkcjonalnosc Rozpoznawania Znakow Optycznych (OCR) do ekstrakcji tekstu z obrazow.

4.1. Korzystanie z IronOCR

IronOCR ułatwia programistom odczytywanie zawartości pliku obrazu dzięki swojej potężnej klasie IronTesseract. Tutaj uzyjemy obrazu PNG, aby przeczytac tekst z pliku obrazowego a kod jest nastepujacy:

var ocr = new IronTesseract();
using (var input = new OcrInput())
{
    // Add the image to be processed
    input.AddImage("test-files/employmentapp.png");

    // Process the image
    var result = ocr.Read(input);

    // Output the extracted text
    Console.WriteLine(result.Text);
}
var ocr = new IronTesseract();
using (var input = new OcrInput())
{
    // Add the image to be processed
    input.AddImage("test-files/employmentapp.png");

    // Process the image
    var result = ocr.Read(input);

    // Output the extracted text
    Console.WriteLine(result.Text);
}
Dim ocr = New IronTesseract()
Using input = New OcrInput()
	' Add the image to be processed
	input.AddImage("test-files/employmentapp.png")

	' Process the image
	Dim result = ocr.Read(input)

	' Output the extracted text
	Console.WriteLine(result.Text)
End Using
$vbLabelText   $csharpLabel

OBRAZ WEJŚCIOWY

Jak drukować kod kreskowy w aplikacji Windows C# Rysunek 12 - Wejście z prostopadłościanami

WYNIK

Jak drukować kod kreskowy w aplikacji Windows C# Rysunek 13 - Wyjście obrazu z pojedynczymi słowami

Wynik działania IronOCR jest zgodny z podanym mu oryginalnym obrazem. Kod jest przejrzysty i łatwy do zrozumienia, bez zbędnych technicznych szczegółów.

4.2. Korzystajac z Google OCR

Google Cloud Vision OCR rowniez konwertuje obraz na tekst z różnymi czcionkami. Najpierw musimy utworzyć klienta za pomocą pliku referencji. Następnie używając tego obiektu klienta, możemy wywołać metodę DetectText, aby uzyskać odpowiedź w formie adnotacji. Kod jest podany poniżej:

Environment.SetEnvironmentVariable("GOOGLE_APPLICATION_CREDENTIALS", "key.json");
var client = ImageAnnotatorClient.Create();
var image = Google.Cloud.Vision.V1.Image.FromFile("test-files/employmentapp.png");
var response = client.DetectText(image);

foreach (var annotation in response)
{
    if (annotation.Description != null)
    {
        Console.WriteLine(annotation.Description);
    }
}
Environment.SetEnvironmentVariable("GOOGLE_APPLICATION_CREDENTIALS", "key.json");
var client = ImageAnnotatorClient.Create();
var image = Google.Cloud.Vision.V1.Image.FromFile("test-files/employmentapp.png");
var response = client.DetectText(image);

foreach (var annotation in response)
{
    if (annotation.Description != null)
    {
        Console.WriteLine(annotation.Description);
    }
}
Environment.SetEnvironmentVariable("GOOGLE_APPLICATION_CREDENTIALS", "key.json")
Dim client = ImageAnnotatorClient.Create()
Dim image = Google.Cloud.Vision.V1.Image.FromFile("test-files/employmentapp.png")
Dim response = client.DetectText(image)

For Each annotation In response
	If annotation.Description IsNot Nothing Then
		Console.WriteLine(annotation.Description)
	End If
Next annotation
$vbLabelText   $csharpLabel

Ten sam obraz jest podany jako dane wejsciowe w celu porownania wynikow obu bibliotek.

Jak drukować kod kreskowy w aplikacji Windows C# Rysunek 14 - Wyjście

Z powyzszego wyniku mozna jasno zobaczyć, ze IronOCR zachowuje formaty wyjścia obrazu. Chociaz Google OCR dało dokładne wyjściowe teksty, formatowanie tabeli nie jest zachowane. IronOCR zachował formatowanie tabeli dokładnie tak, jak w podanym obrazie.

5. Kod Kreskowy i Kod QR na Tekst

5.1. Korzystanie z IronOCR

IronOCR oferuje unikalna i korzystna ceche podczas odczytywania obrazow, to jest mozliwosc czytania kodow kreskowych i QR. Moze wykryc kody kreskowe i wyswietlic ich wartosci z latwoscia. Najpierw ustaw konfigurację ReadBarCodes na true, a następnie iteruj przez każdy z kodów kreskowych w wynikach OCR. Kod do odczytywania kodow kreskowych jest podany poniżej:

var ocr = new IronTesseract();
ocr.Configuration.ReadBarCodes = true;
using (var input = new OcrInput())
{
    // Add the image to be processed
    input.AddImage("test-files/Barcode.png");

    // Process the image
    var result = ocr.Read(input);

    // Iterate and output barcode values
    foreach (var barcode in result.Barcodes)
    {
        Console.WriteLine(barcode.Value);
    }
}
var ocr = new IronTesseract();
ocr.Configuration.ReadBarCodes = true;
using (var input = new OcrInput())
{
    // Add the image to be processed
    input.AddImage("test-files/Barcode.png");

    // Process the image
    var result = ocr.Read(input);

    // Iterate and output barcode values
    foreach (var barcode in result.Barcodes)
    {
        Console.WriteLine(barcode.Value);
    }
}
Dim ocr = New IronTesseract()
ocr.Configuration.ReadBarCodes = True
Using input = New OcrInput()
	' Add the image to be processed
	input.AddImage("test-files/Barcode.png")

	' Process the image
	Dim result = ocr.Read(input)

	' Iterate and output barcode values
	For Each barcode In result.Barcodes
		Console.WriteLine(barcode.Value)
	Next barcode
End Using
$vbLabelText   $csharpLabel

OBRAZ WEJŚCIOWY

Jak drukować kod kreskowy w aplikacji Windows C# Rysunek 15 - Wejście

WYNIK

Jak drukować kod kreskowy w aplikacji Windows C# Rysunek 16 - Wyjście obrazu

Wszystkie trzy kody kreskowe w wejściu zostały pomyślnie odczytane, a ich ukryty tekst zostal wyswietlony.

5.2. Korzystajac z Google OCR

Google Vision API nie oferuje jeszcze tej funkcji. Odczytywanie kodow kreskowych moze byc przydatne w aplikacjach oprogramowania. Jednakże Google OCR pozwala uzyskac tekst z zeskanowanego dokumentu jako plik obrazowy. Kod do wykrywania etykiet jest nastepujacy:

var client = ImageAnnotatorClient.Create();
var image = Google.Cloud.Vision.V1.Image.FromUri("gs://cloud-samples-data/vision/using_curl/shanghai.jpeg");
var labels = client.DetectLabels(image);

Console.WriteLine("Labels (and confidence score):");
Console.WriteLine(new String('=', 30));

foreach (var label in labels)
{
    Console.WriteLine($"{label.Description} ({(int)(label.Score * 100)}%)");
}
var client = ImageAnnotatorClient.Create();
var image = Google.Cloud.Vision.V1.Image.FromUri("gs://cloud-samples-data/vision/using_curl/shanghai.jpeg");
var labels = client.DetectLabels(image);

Console.WriteLine("Labels (and confidence score):");
Console.WriteLine(new String('=', 30));

foreach (var label in labels)
{
    Console.WriteLine($"{label.Description} ({(int)(label.Score * 100)}%)");
}
Imports System

Dim client = ImageAnnotatorClient.Create()
Dim image = Google.Cloud.Vision.V1.Image.FromUri("gs://cloud-samples-data/vision/using_curl/shanghai.jpeg")
Dim labels = client.DetectLabels(image)

Console.WriteLine("Labels (and confidence score):")
Console.WriteLine(New String("="c, 30))

For Each label In labels
	Console.WriteLine($"{label.Description} ({CInt(Math.Truncate(label.Score * 100))}%)")
Next label
$vbLabelText   $csharpLabel

WYNIK

Jak drukować kod kreskowy w aplikacji Windows C# Rysunek 17 - Wyjście wykrywania etykiet

6. PDF na tekst

6.1. Korzystanie z IronOCR

Odczytywanie plikow PDF w IronOCR jest tak proste, jak czytanie plikow obrazow. Wystarczy zmienić metodę AddImage na AddPdf w kodzie odczytu obrazu. Kod wygląda następująco:

var ocr = new IronTesseract();
using (var input = new OcrInput())
{
    // Add the PDF to be processed
    input.AddPdf("test-files/example.PDF");

    // Process the PDF
    var result = ocr.Read(input);

    // Output the extracted text
    Console.WriteLine(result.Text);
}
var ocr = new IronTesseract();
using (var input = new OcrInput())
{
    // Add the PDF to be processed
    input.AddPdf("test-files/example.PDF");

    // Process the PDF
    var result = ocr.Read(input);

    // Output the extracted text
    Console.WriteLine(result.Text);
}
Dim ocr = New IronTesseract()
Using input = New OcrInput()
	' Add the PDF to be processed
	input.AddPdf("test-files/example.PDF")

	' Process the PDF
	Dim result = ocr.Read(input)

	' Output the extracted text
	Console.WriteLine(result.Text)
End Using
$vbLabelText   $csharpLabel

WYNIK

Wyodrebniony tekst jest w tej samej formie, co plik PDF.

Jak drukować kod kreskowy w aplikacji Windows C# Rysunek 18 - Wyjście z PDF do tekstu

6.2. Korzystajac z Google OCR

Google OCR rowniez oferuje mozliwosc ekstrakcji tekstu z dokumentow PDF/TIFF. Jednakże wykrywa tekst tylko wtedy, gdy plik znajduje sie w Google Cloud Storage. Do tego potrzebujesz utworzyc zasob Google Storage. Kod dla C# nie jest prosty ani krotki do wdrozenia tutaj. Nie ma dostepnych przykladow dla C#, aby wykrywac teksty w plikach. Mozesz spojrzec na kod Java jako odniesienie do wyprobowania.

7. Licencjonowanie

IronOCR jest bezpłatny do celów programistycznych, ale do użytku komercyjnego wymaga licencji. Oferuje rowniez darmowa wersje probna do przetestowania wszystkich jego mozliwosci dla twoich potrzeb. Pakiet Lite zaczyna sie od pewnej kwoty z bezplatna wersja probna. IronOCR oferuje 1 rok wsparcia produktowego i aktualizacji za darmo, a nastepnie kolejny rok kosztuje 399 USD. Wszystkie licencje sa wieczyste, co oznacza tylko jednorazowy zakup i brak ukrytych kosztow. Mozesz rowniez wybrac pokrycie redystrybucji bez oplac licencyjnych dla produktow SaaS i OEM z jednorazowym zakupem za 1999 USD. Aby uzyskac wiecej informacji na temat pakietow licencyjnych i planow cenowych, odwiedz nasza strone internetowa tutaj.

Jak drukować kod kreskowy w aplikacji Windows C# Rysunek 19 - Licencja IronOCR

Google Cloud Vision plany cenowe sa oparte na liczbie operacji wykonanych przez aplikacje na obrazie. Dla plikow takich jak PDF-y, ktore maja wiele stron, kazda strona jest traktowana jako obraz. Ponadto kazda funkcja zastosowana do obrazu jest osobnym billowalna jednostka. Dla przykladu, jezeli zastosujesz wykrywanie tekstu i wykrywanie etykiet do tego samego obrazu, kazda funkcja zostanie obciazona osobno. Plany cenowe sa podane ponizej, a wiecej informacji mozna znalezc pod tym linkiem.

Jak drukować kod kreskowy w aplikacji Windows C# Rysunek 20 - Licencja Google Cloud Vision OCR

8. Podsumowanie

IronOCR zapewnia deweloperom C# najbardziej zaawansowane API Tesseract, jakie znamy, na dowolnej platformie. IronOCR moze byc wdrazane na Windows, Linux, Mac, Azure, AWS, Lambda i obsluguje projekty .NET Framework jak rowniez .NET Standard i .NET Core. Możemy również czytać kody kreskowe w skanach OCR i eksportować nasz OCR jako HTML i przeszukiwalne PDF.

Google Cloud Vision API to zaawansowane AI oparte API. Oferuje szeroki zestaw funkcji analizy obrazow, ktore moga byc bardzo pomocne w budowaniu aplikacji ML. Pozwala deweloperom bezposrednio komunikowac sie z Google Cloud przy uzyciu klucza API, co oznacza, ze nie ma potrzeby przechowywania plikow lokalnie.

Licencje IronOCR sa oparte na liczbie uzytkownikow, co oznacza, ze zawsze nalezy kupowac licencje na podstawie liczby deweloperow, ktorzy beda korzystac z produktu. Licencje Google Cloud Vision sa oparte na liczbie obrazow, z ktorych nalezy wyciagnac informacje i analizowac dane. Licencje sa na bazie miesiecznej, a ceny staja sie bardzo wysokie dla duzej liczby obrazow w porownaniu do licencji IronOCR. Dodatkowo licencja IronOCR to jednorazowy zakup i moze byc uzywana przez cale zycie, a takze wspiera dystrybucje OEM i SaaS.

W ogólnym wniosku, obie biblioteki posiadają możliwości uczenia maszynowego. IronOCR ma niewielką przewagę nad Google OCR, ponieważ jest specjalnie zbudowany dla platformy .NET framework, która jest szybka i oszczędza czas. Zapewnia wszystkie funkcje z bardzo niewielką ilością kodu, uwalniając programistów od pisania długich i rozbudowanych kodów. Jest oparty na najpopularniejszym Tesseract 5 API, co ułatwia integrację i analizę obrazów oraz innych formatów plików z dokładnym wynikiem. Z drugiej strony, Google Vision OCR opiera się na AI i jest bardziej ukierunkowany na Javę, Pythona i REST i może działać tylko po podłączeniu do Google Cloud. Może to być czasochłonne, ponieważ odpowiedź przychodzi ze strony serwera. Możesz wybrać bibliotekę zgodnie z Twoimi specyficznymi potrzebami.

Teraz możesz otrzymać 5 produktów Iron w cenie 2. W skład Iron Suite wchodzą następujące narzędzia:

  • IronBarcode
  • IronXL
  • IronOCR
  • IronPDF
  • IronWebScraper

Odwiedź ten link, aby dowiedzieć się więcej.

Możesz pobrać IronOCR z tutaj.

Zwróć uwagęGoogle Cloud Vision OCR jest zarejestrowanym znakiem towarowym odpowiedniego właściciela. Ta strona nie jest powiązana z Google Cloud Vision OCR, ani przez nią popierana czy sponsorowana. Wszystkie nazwy produktów, logo i marki są własnością ich odpowiednich właścicieli. Porównania mają charakter wyłącznie informacyjny i odzwierciedlają informacje dostępne publicznie w momencie pisania.

Często Zadawane Pytania

Jak mogę przekonwertować obrazy na tekst przy użyciu języka C#?

Możesz skorzystać z IronOCR, który wykorzystuje silnik Tesseract 5 do konwersji obrazów na tekst nadający się do odczytu maszynowego. Obsługuje on ponad 125 języków i jest kompatybilny z wieloma platformami, co czyni go doskonałym wyborem do ekstrakcji tekstu w aplikacjach C#.

Jakie są zalety korzystania z IronOCR do skanowania kodów kreskowych i kodów QR?

IronOCR nie tylko konwertuje obrazy i pliki PDF na tekst, ale także doskonale radzi sobie ze skanowaniem kodów BARCODE i kodów QR. Zapewnia szybkie i dokładne wyodrębnianie danych, co czyni go wszechstronnym narzędziem dla aplikacji wymagających kompleksowych funkcji OCR.

W jaki sposób IronOCR obsługuje różne języki?

IronOCR obsługuje ponad 125 języków i oferuje wsparcie dla języków niestandardowych. Ta szeroka kompatybilność językowa pozwala na dużą elastyczność w zastosowaniach międzynarodowych, zapewniając rozpoznawanie tekstu w różnych językach.

Jakie są wymagania instalacyjne dla IronOCR w projekcie C#?

Aby zainstalować IronOCR w projekcie C#, można użyć menedżera pakietów NuGet w Visual Studio. Wystarczy wyszukać IronOCR w menedżerze pakietów NuGet i zainstalować go, aby płynnie zintegrować funkcje OCR z aplikacją.

Jak model licencjonowania IronOCR wypada na tle usług OCR w chmurze?

IronOCR oferuje model jednorazowego zakupu z licencjami wieczystymi, zapewniając długoterminową wartość bez powtarzających się kosztów. Natomiast usługi OCR oparte na chmurze, takie jak Google Cloud Vision, zazwyczaj stosują model cenowy oparty na płatności za rzeczywiste wykorzystanie, co przy intensywnym użytkowaniu może stać się kosztowne.

Jakie platformy są obsługiwane przez IronOCR?

IronOCR można wdrożyć na różnych platformach, w tym Windows, Linux, Mac, Azure, AWS i Lambda. Obsługuje projekty .NET Framework, .NET Standard i .NET Core, oferując wszechstronność dla różnych środowisk programistycznych.

Czy IronOCR może działać w trybie offline?

Tak, IronOCR może działać w trybie offline, co stanowi znaczną przewagę nad rozwiązaniami opartymi na chmurze. Ta funkcja gwarantuje, że przetwarzanie OCR nie jest uzależnione od połączenia internetowego, zapewniając większą kontrolę i bezpieczeństwo.

W jaki sposób IronOCR zapewnia dokładność i szybkość przetwarzania OCR?

IronOCR wykorzystuje zaawansowane algorytmy i silnik Tesseract 5, aby zapewnić szybkie i dokładne przetwarzanie OCR. Filtry korekcji obrazu dodatkowo zwiększają dokładność rozpoznawania tekstu, co czyni go niezawodnym wyborem do zadań OCR wymagających wysokiej jakości.

Kannaopat Udonpant
Inżynier oprogramowania
Zanim stał się inżynierem oprogramowania, Kannapat ukończył doktorat z zasobów środowiskowych na Uniwersytecie Hokkaido w Japonii. W czasie studiowania, Kannapat również został członkiem Laboratorium Robotyki Pojazdów, które jest częścią Wydziału Inżynierii Bioprodukcji. W 2022 roku wykorzystał swoje umiejętności w ...
Czytaj więcej

Zespół wsparcia Iron

Jesteśmy online 24 godziny, 5 dni w tygodniu.
Czat
E-mail
Zadzwoń do mnie