Porównanie pomiędzy IronOCR a Leadtools OCR
Jeśli szukasz informacji na temat OCR, jesteś we właściwym miejscu. Ten blog omawia OCR i powiązane oprogramowanie oraz analizuje, jak sprawdzają się one w zadaniach związanych z OCR. Zacznijmy od pytania: co to jest OCR?
Optical character recognition (OCR) używa skanera optycznego i specjalistycznego oprogramowania do identyfikacji i cyfrowego kodowania zapisanego lub wydrukowanego tekstu. Komputer może odczytywać statyczne zdjęcia tekstu i przekształcać je w edytowalne, przeszukiwalne dane za pomocą oprogramowania OCR.
OCR zazwyczaj składa się z trzech kroków: otwarcia i zeskanowania dokumentu w oprogramowaniu OCR, rozpoznania dokumentu w oprogramowaniu OCR i zapisaniu dokumentu stworzonego przez OCR w preferowanym formacie.
Dziś omawiamy dwa pakiety oprogramowania OCR i porównujemy ich zalety i wady, a także jak zintegrować i wyeksportować ich SDK w C#. Omawiane pakiety oprogramowania to:
- LeadTools OCR
- IronOCR
1. LeadTools OCR
LEADTOOLS OCR pochodzi z nagradzanej linii zestawów narzędzi deweloperskich opracowanych i publikowanych przez LEAD Technologies Inc. LEADTOOLS to zbiór kompleksowych zestawów narzędzi do integracji rastrowych, dokumentowych, medycznych, multimedialnych i wektorowych obrazów w aplikacjach desktopowych, serwerowych, tabletowych i mobilnych. Formaty plików (150+), kompresja obrazów, przetwarzanie obrazów, konwersja kolorów, przetwarzanie kolorów, wyświetlanie obrazów, efekty specjalne, skanowanie/zapisywanie, dialogi ogólne, drukowanie, DICOM, PACS, OCR, kody kreskowe, rozpoznawanie formularzy, PDF, czyszczenie dokumentów, adnotacje i więcej są obsługiwane przez LEADTOOLS. Miliony linii kodu są praktycznie na wyciągnięcie ręki dla deweloperów aplikacji korzystających z zestawu narzędzi LEADTOOLS. LEADTOOLS to zestaw narzędzi stworzonych, aby dostarczyć ci najpotężniejszą technologię obrazówą dostępną, niezależnie od potrzeb programistycznych.
LEADTOOLS to kompleksowy zestaw narzędzi do integracji technologii rozpoznawania, dokumentacyjnych, medycznych, obrazowych i multimedialnych w systemach desktopowych, serwerowych, tabletowych i mobilnych, napędzany unikalnymi algorytmami sztucznej inteligencji i uczenia maszynowego. Aby poprawić swoje aplikacje, dlaczego nie skorzystać z ponad 30 lat wiedzy w zakresie rozwoju obrazów i obsługi ponad 150 typów plików.
Klasa biblioteki OCR LEADTOOLS zapewnia oprogramowanie programistyczne do szybkiego i wydajnego włączenia technologii rozpoznawania znaków optycznych (OCR) do programów oprogramowania. Programiści mogą przeprowadzać rozpoznawanie znaków na obrazach dokumentów i eksportować rozpoznany tekst do ponad 20 formatów plików za pomocą klasy biblioteki OCR LEADTOOLS.
1.1. Funkcje LeadTools OCR
Zestaw narzędzi Lead dostarcza nagradzaną linię technologii multimedialnych dla użytkowników końcowych i deweloperów i jest w stanie wykonywać wszystkie rodzaje funkcji OCR, aby zaspokoić swoich szeroki wachlarz klientów.
1.1.1. Wielowątkowość
Silnik technologii Lead zapewnia użytkownikowi końcowemu wsparcie dla operacji OCR opartych na wielowątkowości i serwerze.
1.1.2. Wiele dokumentów OCR
SDK Dokumentów LeadTools umożliwia użytkownikom tworzenie wielu dokumentów OCR w swojej aplikacji. Każdy dokument zawiera własną listę stron.
1.1.3. Języki
Nagradzana linia technologii LeadTools dostarcza usługi w ponad 40 różnych językach i pozwala na wybór języka, którego chcesz używać przy rozpoznawaniu stron OCR.
1.1.4. Słowniki
LeadTools OCR to niesamowity skaner dokumentów, który pozwala użytkownikowi końcowemu uzyskać dostęp do słowników we wszystkich obsługiwanych językach. Ponadto użytkownicy mogą uzyskać dostęp do więcej niż jednego słownika w jednym dokumencie.
1.1.5. System zarządzania dokumentami
Rozpoznawaj różne dokumenty, w tym faksy, fotokopie i dokumenty o złożonych układach.
1.1.6. Rozpoznawanie znaków
Dzięki poprawionej dokładności i szybkości, Aplikacja OCR LEADTOOLS może przeprowadzać rozpoznawanie znaków optycznych (OCR) na obrazach, wyodrębniać tekst z zdjęć i konwertować obrazy do wielu formatów dokumentów. Aby zmodyfikować i udostępnić tekst z obrazu, używaj OCR, aby go wyodrębnić, a następnie skopiować.
1.1.7. Sztuczna Inteligencja
Lead Technologies używa AI do poprawy rozpoznawania na dokumentach tego samego typu — wspaniała wiadomość dla użytkownika końcowego.
1.1.8. Rozpoznawanie stref
SDK Dokumentów Leadtools, z nagradzanej linii zestawów narzędzi OCR, używa potężnego oprogramowania do rozpoznawania stref, co podnosi je na zupełnie nowy poziom rozpoznawania stref.
- Strony dokumentów mogą być pokazywane z lub bez swoich stref.
- Strefy mogą być importowane z i eksportowane do plików.
- Rozpoznaj stronę jako jedną strefę.
- W ramach każdej strony ręcznie określaj i identyfikuj kilka stref.
- Podczas konstrukcji wielowarstwowych stref i identyfikacji regionów, takich jak tablice, linijki, zdjęcia i tekst, używaj automatycznej segmentacji obszarów.
- Dla każdej strefy zapewnij różne, specjalistyczne wybory, takie jak strefy OMR, MRZ i MICR.
1.1.9. Usługi chmurowe
To wysokowydajny, skalowalny Web API. Przyjazny użytkownikowi interfejs pozwala na łatwe włączenie potężnego OCR, kodów kreskowych, MICR i konwersji dokumentów do dowolnego programu.
Uwaga:
Oficjalna strona NuGet pokazuje, jak bardzo deweloperzy .NET preferują IronOCR od LeadTools. LeadTools ma 77,8 tys. pobrań, ale z drugiej strony IronOCR ma ponad 320 tys. pobrań.
2. IronOCR
IronOCR to biblioteka oprogramowania C# pozwalająca programistom platformy .NET na wykrywanie i czytanie tekstu z obrazów i dokumentów PDF. To czysty pakiet OCR .NET, który używa najpotężniejszego na świecie silnika Tesseract. IronOCR odnosi sukcesy, pracując z grafiką w rzeczywistych warunkach i wadliwymi dokumentami, takimi jak zdjęcia lub przetwarzanie w niskiej rozdzielczości z cyfrowym szumem lub defektami. Z minimalnym lub bez konfiguracji, Tesseract 5 (jak i 4 i 3) działa bezpośrednio na Windows, macOS, Linux, Azure, AWS, Lambda, Mono i Xamarin Mac. Nie ma potrzeby zajmowania się natywnymi plikami binarnymi. Framework i Core są kompatybilne.
IronOCR obsługuje więcej języków niż jakikolwiek inny silnik OCR, co umożliwia programistom tworzenie znaczących kreacji obrazów i wyodrębnianie danych multimedialnych z nich. IronOCR obsługuje 125 języków międzynarodowych, ale tylko angielski jest zainstalowany standardowo w IronOCR.
Serwis oferowany przez zestaw narzędzi IronOCR jest łatwy do integracji, łatwy do przetwarzania i bardziej interaktywny niż jakikolwiek inny silnik OCR. Oferuje rozwiązania dla programistów .NET i pozwala im kontrolować i łączyć się z ich dokumentami cyfrowo, a także manipulować nimi w dowolny sposób.
2.1. Funkcje IronOCR
IronOCR dostarcza unikatowy zestaw funkcji i możliwości do integracji, podpisywania, eksportu, odczytu grafiki i wyodrębniania szczegółów z obrazów, bez względu na techniczne doświadczenie użytkowników lub poziom zaawansowania sprzętu używanego.
2.1.1. Dokładność
SDK IronOCR podnosi dokładność pracy na zupełnie nowy poziom dla bibliotek OCR dzięki wskaźnikowi dokładności wynoszącemu 99,8%, co znacznie przewyższa inne biblioteki OCR.
2.1.2. Naprawa skanów i obrazów niskiej jakości
Klasa IronOCR daje deweloperom C# kontrolę na poziomie detalu. Dostarczają oni możliwość OCR (zdjęcia i PDF na tekst) swoim deweloperom oraz finezyjnie dostrojoną wydajność w każdym unikalnym przypadku.
Pracując z rzeczywistymi przykładami, można osiągnąć doskonałą równowagę między szybkością a dokładnością, ustanawiając zmienne. Usunięcie szumów tła, polepszenie kontrastu, polepszenie rozdzielczości, język, strategia, obracanie i prostowanie, przestrzeń kolorów, wykrywanie białego tekstu na ciemnych tłach i typ obrazu wejściowego to tylko niektóre z dostępnych opcji.
Poniżej znajdują się przykłady obrazów przed i po naprawie skanów niskiej jakości:
Przed
Po
2.1.3. Języki
IronOCR dostarcza rozwiązania w ponad 125 językach międzynarodowych, aby pomóc programistom na całym świecie.
2.1.4. Wydobywanie tekstu OCR
Iron Tesseract może czytać różne typy obrazów i plików PDF. Z tradycyjnymi darmowymi silnikami Tesseract ta funkcja nie jest możliwa. Jeśli skany są słabej jakości, wejście OCR pozwala na automatyczną naprawę stosownych właściwości.
2.1.5. Filtry optymalizacji obrazu
Klasa OCRInput daje programistom C# kontrolę nad wejściem na poziomie detalu. Programiści następnie przygotowują obrazy wejściowe pod kątem pędkości i dokładności. Eliminuje to standardową metodę przygotowywania zdjęć dla OCR za pomocą skryptów wsadowych Photoshop lub ImageMagick.
2.1.6. Region OCR obrazu
Jeśli chodzi o przeprowadzenie OCR na obrazie z szybkością i dokładnością, IronOCR przenosi to na zupełnie nowy poziom. IronOCR umożliwia swoim użytkownikom końcowym wybranie konkretnego obszaru lub regionu na obrazie i wykonanie OCR na tym regionie. Region jest znany jako ContentAreas lub CropAreas.
2.1.7. Klasa OCRResult
IronOCR zwraca zaawansowany obiekt wynikowy dla każdej strony, którą skanuje przy użyciu Tesseract 3, 4 lub 5. Zawiera on dane lokalizacyjne, obrazy, tekst, statystyczną pewność, alternatywne wybory symboli, nazwy czcionek, rozmiary czcionek, dekoracje, grubości czcionek oraz pozycję dla każdego z poniższych elementów:
- Strony
- Akapity
- Liczba wierszy tekstu
- Słowa
- Poszczególne znaki
- Kody kreskowe
2.1.8. Wielojęzyczne dla jednego dokumentu
IronOCR umożliwia programistom używanie więcej niż jednego języka dla jednego dokumentu. Ta funkcja jest bardzo pomocna dla dostawców usług .NET.
Uwaga:
IronOCR jest częścią nagradzanej linii produktów. Wygrywając tę nagrodę, Iron Software pokazuje, że rzeczywiście dostarcza niesamowity skaner dokumentów, który zapewnia znakomite rozpoznawanie, jak również doskonałą konwersję i manipulację związaną z dokumentami.
3. Rozpoczęcie nowego projektu w Visual Studio
Otwórz oprogramowania Visual Studio, przejdź do menu plików i wybierz nowy projekt. Następnie wybierz aplikację konsolową.
Wpisz nazwę projektu i wybierz ścieżkę w odpowiednim polu tekstowym. Następnie kliknij przycisk "Utwórz", a potem wybierz wymagany .NET Framework, tak jak na poniższym zrzucie ekranu:
Projekt Visual Studio teraz utworzy strukturę dla wybranej aplikacji, a jeśli wybrałeś konsolę, aplikację Windows i web, to teraz otworzy plik program.cs, gdzie można wpisać kod i zbudować/uruchomić aplikację.
Następnie możemy dodać bibliotekę, aby przetestować program.
4. Zainstaluj bibliotekę IronOCR
Bibliotekę IronOCR można pobrać i zainstalować na cztery sposoby. Są to:
- Korzystanie z menedżera pakietów NuGet w Visual Studio
- Bezpośrednie pobranie ze strony NuGet.
- Bezpośrednie pobranie ze strony internetowej IronOCR.
- Używanie Visual Studio Command-Line.
4.1. Korzystanie z menedżera NuGet w Visual Studio
IronOCR można zintegrować z projektem C# za pomocą Visual Studio NuGet Package Manager.
- Rozwiń Narzędzia.
- Rozwiń NuGet Package Manager.
- Kliknij Zarządzaj pakietami NuGet dla rozwiązań.
Po tym w pasku wyszukiwania pojawi się nowe okno: wpisz IronOCR.
Używając tej metody, programiści mogą zainstalować bibliotekę IronOCR oraz dowolny pakiet językowy według wyboru programisty.
4.2. Bezpośrednie pobieranie ze strony NuGet
IronOCR można pobrać bezpośrednio ze strony NuGet, postępując zgodnie z poniższymi instrukcjami:
- Przejdź do linku "https://www.nuget.org/packages/IronOcr/"
- Wybierz opcję pakietu do pobrania z menu po prawej stronie.
- Kliknij dwukrotnie pobrany pakiet. Zostanie zainstalowany automatycznie.
- Następnie, przeładuj rozwiązanie i zacznij z niego korzystać w projekcie.
4.3. Bezpośrednie pobieranie ze strony IronOCR
Deweloperzy mogą bezpośrednio pobrać bibliotekę IronOCR ze strony internetowej IronOCR, korzystając z tego linku.
- Kliknij prawym przyciskiem myszy projekt w oknie rozwiązania.
- Następnie wybierz opcję Odniesienia i przejdź do lokalizacji pobranego odniesienia.
- Następnie kliknij OK, aby dodać odniesienie.
4.4. Korzystanie z wiersza poleceń programu Visual Studio
- W Visual Studio przejdź do Narzędzia -> NuGet Package Manager -> Konsola Package Manager
- Wpisz następujący wiersz w zakładce konsoli menedżera pakietów:
Install-Package IronOcr
Pakiet zostanie teraz pobrany/zainstalowany w bieżącym projekcie i będzie gotowy do użycia.
5. Zainstaluj LeadTools OCR
Deweloperzy mogą pobrać SDK LeadTools OCR na trzy różne sposoby, jak pokazano poniżej. Omówimy je wszystkie.
- Korzystanie z Menedżera pakietów NuGet w Visual Studio.
- Korzystając ze strony internetowej NuGet.
- Pobieranie ze strony LeadTools.
5.1. Korzystanie z menedżera NuGet w Visual Studio
LeadTools OCR można zainstalować w projekcie C# za pomocą Visual Studio NuGet Package Manager:
- Rozwiń Narzędzia.
- Rozwiń NuGet Package Manager.
- Kliknij Zarządzaj pakietami NuGet dla rozwiązań.
Po tym, pojawi się nowe okno; w polu wyszukiwania wpisz LeadTools OCR.
Podążając za tymi krokami, deweloperzy mogą zainstalować bibliotekę LeadTools OCR oraz dowolny językowy pakiet wybranego przez dewelopera.
5.2. Korzystanie ze strony internetowej NuGet
LeadTools OCR można pobrać bezpośrednio ze strony internetowej NuGet, podążając za tymi instrukcjami:
- Przejdź do linku "https://www.nuget.org/packages/Leadtools.Ocr/"
- Wybierz opcję pakietu do pobrania z menu po prawej stronie.
- Kliknij dwukrotnie pobrany pakiet. Zostanie zainstalowany automatycznie.
- Następnie, przeładuj rozwiązanie i zacznij z niego korzystać w projekcie.
5.3. Pobieranie ze strony LeadTools
Deweloperzy mogą bezpośrednio pobrać Leadtools Document SDK z ich strony internetowej bez żadnych problemów. Po prostu wejdź na ich stronę internetową i pobierz jeden z pakietów zawierających bibliotekę OCR.
6. OCR wielowątkowy
Obydwa omawiane zestawy oprogramowania oferują usługi dla wielowątkowych silników OCR. Pod tym nagłówkiem przyjrzymy się ich wydajności i szybkości.
6.1. Wielowątkowy OCR LeadTools
LeadTools obsługuje uruchamianie więcej niż jednej instancji OCR jednocześnie, w zależności od fizycznych rdzeni każdego systemu. Ta funkcja Lead Technologies oszczędza dużo czasu dla deweloperów .NET.
// Create an instance of an OCR document from the engine
IOcrDocument ocrDocument = ocrEngineInstance.DocumentManager.CreateDocument();
// Add page, zone them, recognize them and save them to the final document
ocrDocument.Pages.AddPages(imageFileName, null);
ocrDocument.Recognize(null);
ocrDocument.Save(documentFileName, DocumentFormat.Pdf, null);
// Create an instance of an OCR document from the engine
IOcrDocument ocrDocument = ocrEngineInstance.DocumentManager.CreateDocument();
// Add page, zone them, recognize them and save them to the final document
ocrDocument.Pages.AddPages(imageFileName, null);
ocrDocument.Recognize(null);
ocrDocument.Save(documentFileName, DocumentFormat.Pdf, null);
' Create an instance of an OCR document from the engine
Dim ocrDocument As IOcrDocument = ocrEngineInstance.DocumentManager.CreateDocument()
' Add page, zone them, recognize them and save them to the final document
ocrDocument.Pages.AddPages(imageFileName, Nothing)
ocrDocument.Recognize(Nothing)
ocrDocument.Save(documentFileName, DocumentFormat.Pdf, Nothing)
6.2. Wielowątkowy OCR w IronOCR
Korzystanie z funkcji wielowątkowej w IronOCR jest całkiem proste i oszczędza czas dla deweloperów. Iron Tesseract automatycznie spróbuje użyć wszystkich dostępnych wątków na wszystkich rdzeniach, starannie uwzględniając responsywność na głównym wątku interfejsu GUI.
using IronOcr;
var Ocr = new IronTesseract();
using (var Input = new OcrInput())
{
Input.AddPdf("scan.pdf");
// Image processing is automatically multithreaded
Input.Deskew();
// OCR reading is automatically multi-threaded too
var Result = Ocr.Read(Input);
}
using IronOcr;
var Ocr = new IronTesseract();
using (var Input = new OcrInput())
{
Input.AddPdf("scan.pdf");
// Image processing is automatically multithreaded
Input.Deskew();
// OCR reading is automatically multi-threaded too
var Result = Ocr.Read(Input);
}
Imports IronOcr
Private Ocr = New IronTesseract()
Using Input = New OcrInput()
Input.AddPdf("scan.pdf")
' Image processing is automatically multithreaded
Input.Deskew()
' OCR reading is automatically multi-threaded too
Dim Result = Ocr.Read(Input)
End Using
7. Tworzenie przeszukiwalnych plików PDF
Tworzenie przeszukiwalnych plików PDF z łatwością to marzenie każdego dewelopera C#. W tej sekcji omówimy ten proces, używając zarówno SDK IronOCR, jak i SDK Lead Technologies OCR.
7.1. Tworzenie przeszukiwalnych plików PDF z IronOCR
Znakomita aplikacja do skanowania dokumentów w IronOCR pozwala programistom wynieść tworzenie przeszukiwalnych plików PDF na zupełnie nowy poziom, oferując wsparcie w wykrywaniu znaków tekstu na obrazach i zamianie ich na znaczący tekst PDF. Przykład kodu dla użytkowników znajduje się poniżej:
using IronOcr;
var Ocr = new IronTesseract();
using (var Input = new OcrInput())
{
Input.Add(@"images\page1.png");
Input.Add(@"images\page2.bmp");
Input.Add(@"images\page3.tiff");
Input.Deskew();
var Result = Ocr.Read(Input);
Result.SaveAsSearchablePdf("searchable.pdf");
}
using IronOcr;
var Ocr = new IronTesseract();
using (var Input = new OcrInput())
{
Input.Add(@"images\page1.png");
Input.Add(@"images\page2.bmp");
Input.Add(@"images\page3.tiff");
Input.Deskew();
var Result = Ocr.Read(Input);
Result.SaveAsSearchablePdf("searchable.pdf");
}
Imports IronOcr
Private Ocr = New IronTesseract()
Using Input = New OcrInput()
Input.Add("images\page1.png")
Input.Add("images\page2.bmp")
Input.Add("images\page3.tiff")
Input.Deskew()
Dim Result = Ocr.Read(Input)
Result.SaveAsSearchablePdf("searchable.pdf")
End Using
7.2. Tworzenie przeszukiwalnych plików PDF z LeadTools OCR
Lead Technologies oferuje znakomitą aplikację do skanowania dokumentów ze swojej wielokrotnie nagradzanej linii oprogramowania. Jednak dla użytkownika końcowego kod jest nieco bardziej skomplikowany niż ten używany w IronOCR.
private void saveAsSearchablePDFToolStripMenuItem_Click(object sender, EventArgs e)
{
try
{
// Create a document
using (IOcrDocument ocrDocument = _ocrEngine.DocumentManager.CreateDocument(null, OcrCreateDocumentOptions.AutoDeleteFile))
{
// Create IOcrPage from loaded image
_ocrPage = _ocrEngine.CreatePage(_viewer.Image, OcrImageSharingMode.AutoDispose);
// Recognize Text
_ocrPage.Recognize(null);
// Add the page
ocrDocument.Pages.Add(_ocrPage);
// Save page as documentation
SaveFileDialog saveDlg = new SaveFileDialog();
saveDlg.InitialDirectory = @"C:\LEADTOOLS22\Resources\Images";
saveDlg.Filter = "Adobe Portable Document Format|*.pdf";
if (saveDlg.ShowDialog(this) != DialogResult.OK)
return;
ocrDocument.Save(saveDlg.FileName, DocumentFormat.Pdf, null);
MessageBox.Show($"OCR output saved to {saveDlg.FileName}");
}
}
catch (Exception ex)
{
MessageBox.Show(ex.ToString());
}
}
private void saveAsSearchablePDFToolStripMenuItem_Click(object sender, EventArgs e)
{
try
{
// Create a document
using (IOcrDocument ocrDocument = _ocrEngine.DocumentManager.CreateDocument(null, OcrCreateDocumentOptions.AutoDeleteFile))
{
// Create IOcrPage from loaded image
_ocrPage = _ocrEngine.CreatePage(_viewer.Image, OcrImageSharingMode.AutoDispose);
// Recognize Text
_ocrPage.Recognize(null);
// Add the page
ocrDocument.Pages.Add(_ocrPage);
// Save page as documentation
SaveFileDialog saveDlg = new SaveFileDialog();
saveDlg.InitialDirectory = @"C:\LEADTOOLS22\Resources\Images";
saveDlg.Filter = "Adobe Portable Document Format|*.pdf";
if (saveDlg.ShowDialog(this) != DialogResult.OK)
return;
ocrDocument.Save(saveDlg.FileName, DocumentFormat.Pdf, null);
MessageBox.Show($"OCR output saved to {saveDlg.FileName}");
}
}
catch (Exception ex)
{
MessageBox.Show(ex.ToString());
}
}
Private Sub saveAsSearchablePDFToolStripMenuItem_Click(ByVal sender As Object, ByVal e As EventArgs)
Try
' Create a document
Using ocrDocument As IOcrDocument = _ocrEngine.DocumentManager.CreateDocument(Nothing, OcrCreateDocumentOptions.AutoDeleteFile)
' Create IOcrPage from loaded image
_ocrPage = _ocrEngine.CreatePage(_viewer.Image, OcrImageSharingMode.AutoDispose)
' Recognize Text
_ocrPage.Recognize(Nothing)
' Add the page
ocrDocument.Pages.Add(_ocrPage)
' Save page as documentation
Dim saveDlg As New SaveFileDialog()
saveDlg.InitialDirectory = "C:\LEADTOOLS22\Resources\Images"
saveDlg.Filter = "Adobe Portable Document Format|*.pdf"
If saveDlg.ShowDialog(Me) <> DialogResult.OK Then
Return
End If
ocrDocument.Save(saveDlg.FileName, DocumentFormat.Pdf, Nothing)
MessageBox.Show($"OCR output saved to {saveDlg.FileName}")
End Using
Catch ex As Exception
MessageBox.Show(ex.ToString())
End Try
End Sub
8. Kompatybilność
Ta sekcja dotyczy usług, które te pakiety oprogramowania dostarczają, aby wspierać różne platformy. Oba te pakiety oprogramowania zapewniają wsparcie dla wielu platform i systemów operacyjnych.
8.1 Kompatybilność IronOCR
IronOCR .NET SDK to najlepszy SDK OCR, który jest kompatybilny z niemal wszystkimi platformami .NET i systemami operacyjnymi, które wspierają język programowania C#. IronOCR również wspiera różne formaty obrazów, takie jak JPEG, JPG, TIFF i wiele więcej.
Języki .NET:
- C#
- VB.NET
- F#
Platformy:
- .NET 5
- .NET Core 2x i 3x
- .NET Standard 2
- .NET Framework 4x
Typy aplikacji:
- Konsolowe, Webowe i Desktopowe
Systemy operacyjne:
- Microsoft Windows
- Linux (Debian, CentOS, Ubuntu)
- Mac-OS
- Docker (Windows, Linux, Azure)
- Azure (VPS, Webapps, Websites, Functions)
IDE:
- Microsoft Visual Studio
- Jetbrains ReSharper i Rider
8.2 Kompatybilność LeadTools
Lead Technologies również zapewnia wsparcie dla integracji swoich różnych produktów i aplikacji na różnych platformach. Lead Technologies również dostarcza znakomite wsparcie SDK dla swoich użytkowników i programistów.
Systemy operacyjne do wdrażania
- Windows
- Mac-OS 10.10
- iOS 8.0
- Android 4.0 +
Typ komponentu
- .NET
- C#, VB, C++/CLI, XAML
- WinForms, WPF, Web Forms
- Usługi sieciowe
- iOS i mac-OS
- Android
- Linux
Kompatybilne kontenery
- Microsoft Visual Studio
- .NET Framework 4.5
- .NET Framework 4.0
- .NET Framework 3.5
- .NET Framework 3.0
- .NET Framework 2.0
9. Licencjonowanie
Wymagane są licencje na korzystanie z jakiegokolwiek omawianego powyżej oprogramowania. Obydwa zestawy oprogramowania wymagają posiadania licencji przed zalogowaniem się do środowiska. Po zalogowaniu się możesz zacząć uzyskiwać dostęp do ich zupełnie nowego poziomu technologii oprogramowania.
9.1. Licencjonowanie LeadTools
LeadTools zapewnia dwa główne komponenty licencyjne w licencji SDK:
- "Licencja Rozwojowa" pozwala programiście na korzystanie z SDK do rozwoju.
- "Licencja wdrożeniowa" pozwalająca klientowi na wdrożenie lub dystrybucję aplikacji końcowej stworzonej przy użyciu plików do redystrybucji SDK, które zawierają własność intelektualną LeadTool.
Licencja Rozwojowa
Aby rozwijać przy użyciu LEADTOOLS, będziesz potrzebować Licencji Rozwojowej. Licencja Rozwojowa może być zakupiona bezpośrednio od LEAD lub za pośrednictwem autoryzowanego przez LEAD resellera lub dystrybutora.
Licencja Rozwojowa pozwala klientowi na zainstalowanie SDK na maszynie rozwojowej i użycie go do stworzenia aplikacji końcowej poprzez włączenie określonych bibliotek i plików do redystrybucji do aplikacji, korzystając z kodu przykładowego SDK i dokumentacji.
Licencja wdrożeniowa
Korzystanie z aplikacji końcowej stworzonej za pomocą SDK ("Oprogramowanie końcowego użytkownika") przez klienta reguluje Licencja wdrożeniowa.
W przeciwieństwie do standardowej licencji aplikacji końcowego użytkownika, która zabrania jakiegokolwiek kopiowania aplikacji, licencja SDK pozwala użytkownikowi na kopiowanie i redystrybucję części SDK. Aby odtwarzać własność intelektualną LEAD i wdrażać ją z oprogramowaniem końcowego użytkownika wyprodukowanym przy użyciu SDK LEAD, klienci LEAD muszą uzyskać niezbędną licencję wdrożeniową.
9.1.2. Ceny
LeadTools nie oferuje bezpłatnych licencji dla swoich programistów. Zamiast tego, oferuje kompleksowe licencjonowanie oparte na programistach. Aby zobaczyć strukturę cenową SDK OCR Lead Technologies, odwiedź tutaj.
9.2. Licencjonowanie IronOCR
IronOCR to biblioteka, która dostarcza bezpłatną licencję dla programistów. IronPDF również ma odrębną strukturę cenową; zestaw Lite zaczyna się od $999 bez ukrytych opłat. Możliwa jest również redystrybucja produktów SaaS i OEM. Wszystkie licencje oferują 30-dniową gwarancję zwrotu pieniędzy, rok wsparcia i aktualizacji oprogramowania, ważność dla środowisk deweloperskich, testowych i produkcyjnych, oraz licencję wieczystą (jednorazowy zakup). Aby zobaczyć pełną strukturę cenową i szczegóły licencjonowania IronOCR, przejdź tutaj.
Możesz uzyskać redystrybucję produktów SaaS i OEM bez opłat licencyjnych za $1,599 jednorazowy zakup.
10. Podsumowanie i wnioski
10.1. Podsumowanie
IronOCR to biblioteka SDK .NET, która używa najpotężniejszego na świecie silnika Tesseract o nazwie Iron Tesseract. Obsługuje ponad 125+ języków międzynarodowych. IronOCR to znakomita aplikacja do skanowania dokumentów z wieloma funkcjami obrazu, takimi jak OCR regionu obrazu, ekstrakcja tekstu z obrazów, naprawa obrazu o niskiej rozdzielczości i wykonywanie OCR na określonym regionie obrazu, oraz wiele innych związanych funkcji. IronOCR koncentruje się na zapewnieniu prędkości wraz z precyzją, a jego poziom dokładności wynoszący 99,8% jest wyższy niż jakiegokolwiek innego Tesseract OCR na rynku. IronOCR działa od razu po wyjęciu z pudełka, bez potrzeby dostrajania wydajności czy mocno modyfikowania obrazów wejściowych. Ponadto, zawsze możesz otrzymać wszystkie pięć produktów Iron Software za cenę dwóch. Kliknij tutaj, aby zobaczyć stronę www.
- IronPDF
- IronOCR
- IronXL
- IronBarcode
- IronWebScraper
LeadTools OCR to zestaw narzędzi od LeadTools, który szybko i efektywnie oferuje większość funkcji rozpoznawania. Programiści mogą prowadzić rozpoznawanie znaków na obrazach dokumentów i wyprowadzać rozpoznawany tekst do ponad 20 formatów plików, używając biblioteki klas LEADTOOLS OCR. Jej biblioteka może być zintegrowana z większością języków programowania i niemal wszystkimi dostępnymi na rynku platformami. Jej funkcje obejmują:
- Szybkie i dokładne OCR z obsługą wielowątkową
- Obsługa szerokiego zestawu znaków językowych OCR, w tym latynki, cyrylicy, języków wschodnioazjatyckich i arabskich
- Zapisywanie wyników OCR do ponad 40 formatów wyjściowych, w tym przeszukiwalny PDF, PDF/A, Word i XML
- OCR całostronicowe i strefowe
- Wbudowane i niestandardowe słowniki sprawdzania pisowni w celu poprawienia wyników OCR
- Potężne funkcje czyszczenia i wstępnego przetwarzania obrazów dokumentów w celu poprawienia wyników OCR z zeskanowanych obrazów
10.2. Wnioski
IronOCR i LeadTools OCR to oba zaawansowane narzędzia i oferują wszystkie funkcje, jakie mogliby sobie wymarzyć deweloperzy C# lub .NET. IronOCR jest łatwiejsze w użyciu i kodowaniu niż jego konkurent. Oba zestawy oprogramowania nie generują bieżących kosztów, ale IronOCR jest dużo bardziej efektywne kosztowo niż Biblioteka OCR LeadTools. IronOCR oferuje większą dokładność niż jakikolwiek z jego konkurentów na rynku. IronOCR oferuje wsparcie dla międzynarodowych języków dla ponad 125+ języków. Z drugiej strony, LeadTools oferuje wsparcie tylko dla 40+ języków. Biorąc pod uwagę wszystkie różne aspekty wydajności, jedynym wnioskiem, jaki możemy wyciągnąć, jest to, że IronOCR ma znaczne przewagi nad LeadTools OCR.
Często Zadawane Pytania
Jak mogę poprawić dokładność OCR na skanach o niskiej jakosci?
IronOCR oferuje funkcje takie jak usuwanie szumu tła, poprawa kontrastu, poprawa rozdzielczości i wykrywanie białego tekstu na ciemnym tle w celu poprawy jakości obrazów o niskiej rozdzielczości, co zwiększa dokładność OCR.
Czy mogę tworzyć dokumenty OCR w wielu językach przy użyciu tej biblioteki?
Tak, IronOCR obsługuje ponad 125 języków, umożliwiając programistom przetwarzanie i tworzenie dokumentów w wielu językach, co czyni go odpowiednim do zastosowań OCR w wielu językach.
Jakie są wymagania systemowe dla tej biblioteki OCR?
IronOCR jest zgodny z platformami .NET i można go używać w systemach operacyjnych Windows, Linux i macOS. Dobrze integruje się ze środowiskami programistycznymi, takimi jak Visual Studio i Jetbrains ReSharper & Rider.
Jak ta biblioteka OCR radzi sobie z różnymi formatami dokumentów?
IronOCR może przetwarzać różne formaty obrazów i konwertować je na tekst lub pliki PDF, umożliwiając tworzenie przeszukiwalnych plików PDF i innych typów dokumentów.
Czy używanie tej biblioteki OCR wiąże się z opłatą licencyjną?
IronOCR oferuje prosty model licencjonowania, który jest bardziej opłacalny w porównaniu do innych bibliotek OCR, unikając oddzielnych licencji na rozwój i wdrożenie wymaganych przez niektóre alternatywy.
Jak wsparcie językowe tego narzędzia OCR wypada w porównaniu z innymi?
IronOCR obsługuje ponad 125 języków, co jest znacząco więcej niż wiele innych narzędzi OCR, czyniąc go doskonałym wyborem dla aplikacji wymagających szerokiego wsparcia językowego.
Co sprawia, że ta biblioteka OCR jest dobrym wyborem dla deweloperów C# w porównaniu do innych?
IronOCR jest znany z wysokiej dokładności na poziomie 99,8%, łatwości integracji z projektami .NET, szerokiego wsparcia językowego oraz opłacalnych licencji, co czyni go preferowanym wyborem dla deweloperów C#.
Czy ta biblioteka OCR może być używana w aplikacjach opartych na serwerze?
Tak, IronOCR obsługuje wielowątkowość i może być używane w aplikacjach opartych na serwerze do efektywnego przetwarzania dużej ilości zadań OCR.

